智能座舱

阶跃发布全新语音大模型 StepAudio 3系列:覆盖语音识别、生成、实时交互与音乐创作

InfoQ中文·2026/9/17 15:50:57🔗 原文

📋总体概括

阶跃星辰发布全新语音大模型StepAudio 3系列,能力覆盖语音识别、语音生成、实时交互与音乐创作四大方向,试图以单一模型族打通语音链路各环节。在智能汽车座舱加速向多模态自然交互演进背景下,语音大模型正成为车企与供应商争夺的新入口,阶跃此番发布意在切入车载语音、实时对话等高价值场景。

关键信息

  • 阶跃星辰发布StepAudio 3系列语音大模型,为一次覆盖多能力的版本更新
  • 模型能力覆盖语音识别、语音生成、实时交互与音乐创作四大方向
  • 实时交互能力指向低延迟对话场景,与车载语音助手需求高度契合
  • 语音大模型赛道竞争者增多,座舱自然交互成为落地焦点

🔥犀利点评

标题里四个能力全写上,恰恰说明这是个平台型发布而非单点突破——什么都想做,往往意味着还没有一个能打的杀手级场景。语音识别、生成各家都在卷,真正的分水岭是车规级实时交互的延迟与稳定性,阶跃若拿不出量产车企背书,这类发布就只是技术发布会而非产业事件。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文