阿里Qwen语音合成模型上线OpenRouter
阿里Qwen-Audio-3.0-TTS(Flash/Plus)语音合成模型上线OpenRouter,支持16种语言及情绪化语气提示。
AI 深度解读
阿里通义千问旗下两款新一代语音合成模型 Qwen-Audio-3.0-TTS 已上线 OpenRouter,开发者可直接通过统一 API 调用,是国产语音合成能力借船出海分发的又一例证。
- 同时发布 Flash 和 Plus 两个版本,分别侧重响应速度与合成质量,覆盖不同成本敏感度的应用场景
- 支持 16 种语言,具备较强的多语种配音覆盖能力
- 模型能遵循自然语言指令调整语气、语速等表达方式,而非依赖预设参数
- 引入“【gasp】”“【giggles】”“【angry】”等内联情绪提示标签,可在脚本中直接标注喘息、轻笑、愤怒等情绪化表现,提升配音的戏剧张力
- 借助 OpenRouter 这一聚合平台分发,省去开发者单独对接阿里云的成本,降低了国际用户的使用门槛
- 看点:语音合成正从“能说话”走向“会演戏”,情绪化内联指令若效果扎实,将对海外配音、播客、有声书等场景的现有玩家形成直接竞争压力。
本内容由 AI 生成,仅供参考,请注意甄别