阶跃星辰发布 StepAudio 3 系列语音大模型,全套上线开放平台
阶跃星辰发布 StepAudio 3 系列语音大模型,涵盖实时交互与语音识别等五款模型并全套上线开放平台。
AI 深度解读
阶跃星辰于 2026 年 9 月 15 日发布 StepAudio 3 系列语音大模型并上线开放平台,重点改进了全双工交互、语境识别与异步任务执行能力。
- 系列模型涵盖 Realtime、ASR、TTS、Gen 和 Music 五款模型,覆盖实时对话、转写、生成与音频创作等方向。
- StepAudio 3 Realtime 支持原生全双工对话与副语言理解,并在评测机构 Artificial Analysis 的 Conversational Dynamics 榜单取得 98.9% 综合得分,在 Speech Reasoning 榜单取得 99.7% 准确率。
- 模型支持语音生成与复杂推理并行运作,长任务与工具调用可异步执行而不中断当前语音流。
- StepAudio 3 ASR 结合大语言模型语义理解,针对中英文混说、方言及专业术语转写进行针对性优化。
- 影响/看点:原生全双工与异步工具调用的结合提升了语音交互的连贯度,若在多并发网络环境下保持低延迟与高稳定性,将推动语音助手向更复杂的业务协同场景落地。
- 资料依据:
- IT之家(2026-09-15):https://www.ithome.com/1/002/602.htm
- Artificial Analysis 语音评测榜单(2026-09-15):https://artificialanalysis.ai/leaderboards/audio
本内容由 AI 生成,仅供参考,请注意甄别