Claude Opus 5 登顶 AA-Briefcase 智能体知识工作基准

📡 Artificial Analysis2026-07-25 06:10

Claude Opus 5以1720 Elo登顶AA-Briefcase智能体知识工作基准,成本较Fable 5低两成以上

AI 深度解读

第三方评测机构 Artificial Analysis 公布的 AA-Briefcase 智能体知识工作基准显示,Claude Opus 5 以显著优势登顶,同时在成本上也优于前代旗舰 Fable 5。

  • 榜首成绩:Opus 5 在该基准上拿到 1720 Elo,领先 Claude Fable 5 达 146 分,是目前榜单上能力最强的模型。
  • 成本对比(max 设置):完成单个任务的成本为 17.79 美元,比 Fable 5 低 20%,做到了“更强还更省”。
  • 成本对比(high 设置):任务成本降至 10.41 美元,不到 Fable 5 的一半,Elo 分数仍领先 32 分,性价比优势进一步放大。
  • AA-Briefcase 面向“智能体知识工作”场景设计,更贴近真实办公与文档处理类任务,而非单纯的代码或数学测试。
  • 这份第三方评测印证了 Opus 5“高性价比旗舰”的定位,对正在评估智能体产品选型的企业和开发者是重要的参考数据点。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com