[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"aihot-art-96916":3},{"itemId":4,"vertical":5,"category":6,"source":7,"score":8,"title":9,"summary":10,"analysis":11,"url":12,"coverUrl":13,"direction":13,"marketSignal":13,"publishedAt":14},"96916","ai","产品发布\u002F更新","MarkTechPost",68,"阿里通义实验室发布Qwen-Audio-3.0-TTS：支持16种语言的文本转语音模型","阿里通义实验室发布Qwen-Audio-3.0-TTS，支持16种语言，分Flash和Plus版本。","阿里通义实验室发布Qwen-Audio-3.0-TTS，支持16种语言的文本转语音模型，提供Flash和Plus两个版本。\n· Flash版本针对实时交互，首包延迟约300毫秒；Plus版本追求高质量生成，在自然度和音色保真度上更优。\n· 模型采用12.5Hz低帧率语音分词器，降低自回归解码成本；五阶段渐进训练范式提升内容一致性和韵律自然度。\n· 支持最长3分钟的一次性合成，以及语音克隆、声音设计、指令控制等功能。\n· 输出格式包括PCM、WAV、MP3、Opus，最高48kHz采样率，通过WebSocket流式协议调用。\n· Plus版本在独立评测中排名第一，覆盖阿拉伯语、中文、英语等16种语言。\n影响\u002F看点：Qwen-Audio-3.0-TTS在实时性和质量上取得平衡，多语言支持将推动AI语音助手全球化。","https:\u002F\u002Fwww.marktechpost.com\u002F2026\u002F07\u002F20\u002Falibabas-tongyi-lab-releases-qwen-audio-3-0-tts-a-hosted-text-to-speech-model-in-flash-and-plus-tiers-across-16-languages\u002F",null,"2026-07-21 05:14:19"]