Google DeepMind 官方发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音大模型

📡 Google DeepMind2026-09-23 23:25

Google DeepMind 推出两款 TTS 模型,其中 Flash 版本主打个性化声音定制,Flash-Lite 则侧重高效大规模生成。

AI 深度解读

Google DeepMind 于 2026 年 9 月 23 日公布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,针对不同应用场景划分高表现力创作与高吞吐部署两条技术路径。

  • Gemini 3.8 Flash TTS 聚焦个性化定制,支持根据口音与音色特征设计特定角色声线。
  • Gemini 3.8 Flash-Lite TTS 主打高效部署与低成本扩展,适配大规模批量语音生成与实时交互需求。
  • 支持在自建声音风格与现成预设语音库之间灵活切换,兼顾灵活性与标准化。
  • 影响/看点:双版本架构可能满足从内容创作者到企业级开发者的分层需求,其商业化表现将受制于单位推理成本与多端部署调优体验。
  • 资料依据:
  • X:Google DeepMind(2026-09-23):https://x.com/GoogleDeepMind/status/2102781530867126505
  • Google DeepMind Blog(2026-09-23):https://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手