通义千问发布 Qwen-Audio-3.0-TTS,登顶 TTS 排行榜

📡 通义千问 / Qwen2026-07-23 20:33

通义千问推出Qwen-Audio-3.0-TTS语音模型,支持情绪标签控制、16种语言及3分钟长文本生成,登顶TTS排行榜。

AI 深度解读

通义千问发布 Qwen-Audio-3.0-TTS,登顶 TTS 排行榜,提供实时与高质量双版本。

  • 提供 Flash(实时交互)和 Plus(高质量生成)两个版本,满足不同场景需求。
  • 支持细粒度内联标签控制,如【whisper】、【angry】,以及自然语言风格控制,情感表达更丰富。
  • 支持 16 种语言,可一次生成长达 3 分钟的长文本,在 Artificial Analysis TTS 排行榜上排名第一。
  • 影响/看点:Qwen-Audio-3.0-TTS 在控制力和多语言能力上取得显著进步,为语音交互带来更自然、更细腻的体验。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com