阶跃星辰发布 StepAudio 3 系列语音大模型,全套上线开放平台

📡 IT之家2026-09-15 15:45

阶跃星辰发布 StepAudio 3 系列语音大模型,涵盖实时交互与语音识别等五款模型并全套上线开放平台。

AI 深度解读

阶跃星辰于 2026 年 9 月 15 日发布 StepAudio 3 系列语音大模型并上线开放平台,重点改进了全双工交互、语境识别与异步任务执行能力。

  • 系列模型涵盖 Realtime、ASR、TTS、Gen 和 Music 五款模型,覆盖实时对话、转写、生成与音频创作等方向。
  • StepAudio 3 Realtime 支持原生全双工对话与副语言理解,并在评测机构 Artificial Analysis 的 Conversational Dynamics 榜单取得 98.9% 综合得分,在 Speech Reasoning 榜单取得 99.7% 准确率。
  • 模型支持语音生成与复杂推理并行运作,长任务与工具调用可异步执行而不中断当前语音流。
  • StepAudio 3 ASR 结合大语言模型语义理解,针对中英文混说、方言及专业术语转写进行针对性优化。
  • 影响/看点:原生全双工与异步工具调用的结合提升了语音交互的连贯度,若在多并发网络环境下保持低延迟与高稳定性,将推动语音助手向更复杂的业务协同场景落地。
  • 资料依据:
  • IT之家(2026-09-15):https://www.ithome.com/1/002/602.htm
  • Artificial Analysis 语音评测榜单(2026-09-15):https://artificialanalysis.ai/leaderboards/audio

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手