Google DeepMind 官方发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音大模型
Google DeepMind 推出两款 TTS 模型,其中 Flash 版本主打个性化声音定制,Flash-Lite 则侧重高效大规模生成。
AI 深度解读
Google DeepMind 于 2026 年 9 月 23 日公布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,针对不同应用场景划分高表现力创作与高吞吐部署两条技术路径。
- Gemini 3.8 Flash TTS 聚焦个性化定制,支持根据口音与音色特征设计特定角色声线。
- Gemini 3.8 Flash-Lite TTS 主打高效部署与低成本扩展,适配大规模批量语音生成与实时交互需求。
- 支持在自建声音风格与现成预设语音库之间灵活切换,兼顾灵活性与标准化。
- 影响/看点:双版本架构可能满足从内容创作者到企业级开发者的分层需求,其商业化表现将受制于单位推理成本与多端部署调优体验。
- 资料依据:
- X:Google DeepMind(2026-09-23):https://x.com/GoogleDeepMind/status/2102781530867126505
- Google DeepMind Blog(2026-09-23):https://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech/
本内容由 AI 生成,仅供参考,请注意甄别