Fable 5.1 在 ARC-AGI-2 取得 90.0% 突破,单任务推理成本降低 32%

📡 Rohan Paul2026-09-02 21:37

Anthropic 的 Fable 5.1 在 ARC-AGI-2 取得 90% 得分,单任务推理成本降低约 32%。

AI 深度解读

ARC Prize 官方于 2026 年 9 月 2 日公布 Anthropic 旗下 Fable 5.1 模型在抽象推理基准 ARC-AGI 上的评测成绩,该模型在保持高准确率的同时降低了单任务推理成本。

  • 据 ARC Prize 官方数据与行业分析师 Rohan Paul 于 2026 年 9 月 2 日的汇总,Fable 5.1 在 ARC-AGI-2 基准上取得 90.0% 的验证得分,单任务成本为 3.12 美元。
  • 在 ARC-AGI-1 基准上,该模型得分达 97.5%,单任务成本为 1.40 美元。
  • 凭借优化的 Token 利用效率,Fable 5.1 在两项基准上的平均单任务成本相比前代 Fable 5 降低了约 32%,体现了测试时推理规划效率的改进。
  • 影响/看点:Fable 5.1 在抽象归纳任务上的高分与成本优化,意味着前沿复杂推理模型正在向更可负担的成本区间靠拢,其广泛推广的前提是在通用泛化场景中保持同等的高 Token 转化效率。
  • 资料依据:
  • X:Rohan Paul (@rohanpaul_ai)(2026-09-02):https://x.com/rohanpaul_ai/status/2095143998621147517
  • ARC Prize 官方榜单(2026-09-02):https://arcprize.org/leaderboard

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手