谷歌官方发布 Gemini 3.8 文本转语音(TTS)模型

📡 Hacker News 热门2026-09-24 01:54

谷歌正式发布 Gemini 3.8 文本转语音(TTS)模型。

AI 深度解读

谷歌于 2026 年 9 月 23 日在官方博客发布 Gemini 3.8 文本转语音(TTS)模型系列,推出面向精细创作的 Flash TTS 与面向高并发场景的 Flash-Lite TTS。

  • Gemini 3.8 Flash TTS 支持通过自然语言提示词定制声音角色,可精细调控跨 100 多种语言的语调、停顿与口语反馈。
  • Gemini 3.8 Flash-Lite TTS 针对高并发配音与实时语音智能体进行了计算效率优化。
  • 系统提供 2,000 余种预置声音,并支持基于 30 秒音频样本进行声音复刻,内置 SynthID 水印与 C2PA 内容凭证以强化溯源。
  • 影响/看点:自然语言驱动的声音设计若能保证长文本输出风格的一致性,可能推动内容制作与交互播报由固定音色库向动态按需生成转变。
  • 资料依据:
  • Google Blog(2026-09-23):https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
  • Google Cloud Documentation(2026-09-23):https://cloud.google.com/vertex-ai/generative-ai/docs/multimodal/tts

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手