GPT-6 Astra 登顶数学评测榜,OpenAI 称重心正转向递归自改进

📡 The Decoder2026-09-10 21:45

OpenAI旗下GPT-6 Astra登顶数学评测榜,官方称研发重心已转向递归自改进与对齐研究。

AI 深度解读

OpenAI 旗下模型 GPT-6 Astra 在数学公开难题评测基准 ErdosBench 上取得领先成绩,但官方表示并未对数学能力进行专项优化,其研发重心已转向递归自改进与对齐研究。

  • 根据 The Decoder 于 2026 年 9 月 10 日的报道与评测数据,GPT-6 Astra 在包含 226 道开放数学题的 ErdosBench 测试中取得 3.23 分,共解决 106 道题目,其中 43 道实现完整求解,另推翻了 27 道题目前设。
  • OpenAI 首席科学家 Jakub Pachocki 在 2026 年 9 月 10 日发表的文章《An Alien Mind》中说明,团队判断若投入额外专项优化可让模型在数学研究上表现更强,但出于对递归自改进(RSI)与自动化对齐研究紧迫性的考虑,未将数学专项优化列为优先方向。
  • 这一技术取舍表明前沿大模型能力演进呈现非均匀特征,特定领域的表现目前仍取决于算力与数据资源的分配偏好。
  • 影响/看点:OpenAI 将研发资源集中于递归自改进,意味着未来模型能力提升可能更多依赖模型自身生成的优化反馈,但这一路径能否带来跨领域的稳定能力提升,取决于自主迭代与安全对齐技术在复杂任务中的有效性。
  • 资料依据:
  • The Decoder(2026-09-10):https://the-decoder.com/gpt-6-astra-gives-mathematicians-a-breather-and-openai-says-thats-by-design/
  • OpenAI(2026-09-10):https://openai.com/index/an-alien-mind/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手