通义千问发布 Qwen-Audio-3.0-TTS,登顶 TTS 排行榜
通义千问推出Qwen-Audio-3.0-TTS语音模型,支持情绪标签控制、16种语言及3分钟长文本生成,登顶TTS排行榜。
AI 深度解读
通义千问发布 Qwen-Audio-3.0-TTS,登顶 TTS 排行榜,提供实时与高质量双版本。
- 提供 Flash(实时交互)和 Plus(高质量生成)两个版本,满足不同场景需求。
- 支持细粒度内联标签控制,如【whisper】、【angry】,以及自然语言风格控制,情感表达更丰富。
- 支持 16 种语言,可一次生成长达 3 分钟的长文本,在 Artificial Analysis TTS 排行榜上排名第一。
- 影响/看点:Qwen-Audio-3.0-TTS 在控制力和多语言能力上取得显著进步,为语音交互带来更自然、更细腻的体验。
本内容由 AI 生成,仅供参考,请注意甄别