阿里发布 Qwen-Audio-3.1 全系音频大模型并最高降价 95%
阿里千问团队推出 Qwen-Audio-3.1 音频模型家族,新增两款新模型并将 API 价格最高下调 95%。
AI 深度解读
2026年9月23日,阿里巴巴通义千问发布 Qwen-Audio-3.1 系列音频模型并同步下调 API 接口资费,展示了音频大模型在多模态理解、生成及实时交互维度的演进与成本优化。
- 覆盖语音识别、生成与交互能力:根据阿里云官方文档与 The Decoder 报道,该系列推出了涵盖语音识别(ASR)、语音合成(TTS)以及实时全双工语音交互(Realtime)等多种细分版本。
- 语音理解与生成功能迭代:新版 ASR 模型优化了多语种与方言识别,支持自动过滤口语填充词与重复表达;TTS-Next 则支持基于文本与参考音频一次性生成包含人声与环境背景音的复合音频。
- API 调用资费下调:官方资费调整信息显示,ASR 模型调用费用下调最高达 95%,Realtime 实时交互模型降价约 85%,TTS 模型降价约 70%。
- 影响/看点:API 资费下调与端到端实时交互能力的整合,可能降低智能客服、播客制作及语音助手等场景的工程集成门槛,但其实际落地效益仍取决于模型在高噪复杂环境下的识别稳定性与并发调用时的端到端响应延迟。
- 资料依据:
- The Decoder(2026-09-23):https://the-decoder.com/alibaba-launches-qwen-audio-3-1-with-five-new-models-and-slashes-ai-audio-prices-by-up-to-95-percent/
- 阿里云(2026-09-23):https://help.aliyun.com/zh/model-studio/user-guide/qwen-audio
本内容由 AI 生成,仅供参考,请注意甄别