Artificial Analysis发布Grok 4.7权威评测:性能紧随Opus 5且任务成本减半

📡 Artificial Analysis2026-09-22 06:57

Artificial Analysis 评测显示 Grok 4.7 表现紧随 Opus 5,且任务运行成本减少约 50%。

AI 深度解读

第三方评测机构 Artificial Analysis 发布针对 Grok 4.7 的量化测试结果,从分析质量、报告制作与调用成本等多维度提供了独立评测数据。

  • Artificial Analysis 于 2026 年 9 月 21 日公布的 AA-Briefcase 基准显示,Grok 4.7 表现仅次于 Anthropic 的 Opus 5,单任务成本约为后者的 50%。
  • 在 AA-Briefcase-Lite 商业尽调测试中,Grok 4.7 分析质量 Elo 评分由 4.6 版本的 1698 提升至 1994,但展示生成 Elo 评分由 1531 调整为 1499。
  • API 成本测算显示,生成样本报告时 Grok 4.7 成本约为 8 美元,高于 Grok 4.6 的 4.40 美元,反映出更高推理深度带来的计算开销变化。
  • 影响/看点:评测表明该模型在专业逻辑分析能力上有所增强,但单次调用成本的上升意味着企业在采购时需要在任务精度与预算控制之间进行权衡。
  • 资料依据:
  • Artificial Analysis(2026-09-21):https://x.com/ArtificialAnlys/status/2102170392924492207
  • xAI(2026-09-21):https://x.ai/news/grok-4-7

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手