Artificial Analysis 评测 Gemini 3.8 Live:Extended Thinking 版本登顶语音模型基准榜

📡 Artificial Analysis2026-09-16 05:44

Artificial Analysis评测显示,谷歌Gemini 3.8 Live思维扩展版登顶语音到语音综合基准榜。

AI 深度解读

评测机构 Artificial Analysis 发布对 Google 语音到语音模型 Gemini 3.8 Live 的独立评测结果,展示了扩展思维机制在实时语音交互与复杂推理任务中的性能表现。

  • Artificial Analysis 数据显示,Gemini 3.8 Live 的 Extended Thinking(High)版本在 Speech to Speech Index 评测中取得 82.6 分,位列该基准榜首。
  • 在针对复杂对话理解与多步骤任务的 Tau Voice 基准测试中,该模型以 68.6% 的准确率排名第一。
  • 评测表明开启高强度 Extended Thinking 机制后,模型在保持端到端低延迟对话的同时增强了复杂逻辑分析能力。
  • 影响/看点:该评测结果表明语音到语音大模型正逐步具备深度推理能力,若其在生产环境下的高算力开销与交互首包延迟能得到有效平衡,可能进一步拓展复杂客服与专业实时辅助等应用场景。
  • 资料依据:
  • Artificial Analysis(2026-09-15):https://artificialanalysis.ai/models/gemini-3-8-live
  • X:Artificial Analysis (@ArtificialAnlys)(2026-09-15):https://x.com/ArtificialAnlys/status/2099977679307243773

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手