Fable 5.1 在 ARC-AGI-2 取得 90.0% 突破,单任务推理成本降低 32%
Anthropic 的 Fable 5.1 在 ARC-AGI-2 取得 90% 得分,单任务推理成本降低约 32%。
AI 深度解读
ARC Prize 官方于 2026 年 9 月 2 日公布 Anthropic 旗下 Fable 5.1 模型在抽象推理基准 ARC-AGI 上的评测成绩,该模型在保持高准确率的同时降低了单任务推理成本。
- 据 ARC Prize 官方数据与行业分析师 Rohan Paul 于 2026 年 9 月 2 日的汇总,Fable 5.1 在 ARC-AGI-2 基准上取得 90.0% 的验证得分,单任务成本为 3.12 美元。
- 在 ARC-AGI-1 基准上,该模型得分达 97.5%,单任务成本为 1.40 美元。
- 凭借优化的 Token 利用效率,Fable 5.1 在两项基准上的平均单任务成本相比前代 Fable 5 降低了约 32%,体现了测试时推理规划效率的改进。
- 影响/看点:Fable 5.1 在抽象归纳任务上的高分与成本优化,意味着前沿复杂推理模型正在向更可负担的成本区间靠拢,其广泛推广的前提是在通用泛化场景中保持同等的高 Token 转化效率。
- 资料依据:
- X:Rohan Paul (@rohanpaul_ai)(2026-09-02):https://x.com/rohanpaul_ai/status/2095143998621147517
- ARC Prize 官方榜单(2026-09-02):https://arcprize.org/leaderboard
本内容由 AI 生成,仅供参考,请注意甄别