Google DeepMind官方发布Gemini 3.8 Live与3.8 Live Extended Thinking实时语音模型

📡 Google DeepMind Blog2026-09-16 01:05

Google DeepMind 发布 Gemini 3.8 Live 系列实时语音模型,支持实时双向语音交互与扩展思维推理。

AI 深度解读

Google DeepMind 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两款近实时语音模型,重点提升了复杂任务下的实时推理与交互效率。

  • Gemini 3.8 Live 侧重规模化与低成本,支持视觉上下文实时理解与 97 种语言切换,可在后台调用工具时维持对话流畅。
  • Gemini 3.8 Live Extended Thinking 针对复杂流程设计,支持边思考边同步语音输出,在 τ-Voice 测试中取得 68.6% 的任务完成率。
  • 两款模型通过 Gemini Enterprise Agent Platform 的 Live API 开放,致力于平衡交互响应质量与业务执行准确率。
  • 影响/看点:实时语音与多步推理的深度结合,意味着企业级语音智能体在自动化业务流程中的实用度可能显著提高,其实际效果取决于多工具链条的对接稳定度与延迟表现。
  • 资料依据:
  • Google DeepMind Blog(2026-09-15):https://deepmind.google/blog/introducing-gemini-3-8-live-and-3-8-live-extended-thinking/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手