Artificial Analysis 发布 Grok 4.7 评测:编码智能体得分升至 56
Artificial Analysis公布评测结果,Grok 4.7智能指数达46分,助xAI跻身前四大AI实验室。
AI 深度解读
独立 AI 评测机构 Artificial Analysis 发布了对 xAI 新模型 Grok 4.7 的基准测试数据,从第三方视角量化评估其综合能力与编程表现。
- 在综合智能指数(Intelligence Index)中获得 46 分,较前代 Grok 4.6 提升 2 分,使 xAI 在该榜单中进入前四大 AI 实验室梯队。
- 在编码智能体指数(Coding Agent Index)中得分升至 56 分,体现出其在复杂工程代码生成与智能体流程中的相对优势。
- 评测提供了独立于官方技术报告的外部基准参照,覆盖推理质量与智能体代码执行等维度。
- 影响/看点:第三方机构评测结果为企业开发者选型提供了客观参照,表明 Grok 4.7 在编程智能体领域具备较强竞争力,但开发者实际采购仍需结合 API 稳定性与端到端响应时延综合考量。
- 资料依据:
- X:Artificial Analysis(2026-09-21):https://x.com/ArtificialAnlys/status/2102074898327932987
- Artificial Analysis(2026-09-21):https://artificialanalysis.ai/models/grok-4-7
本内容由 AI 生成,仅供参考,请注意甄别