OpenAI 发布 GPT-6 Astra:基准表现与定价详解

📡 Simon Willison 博客2026-09-04 04:18

OpenAI 推出 GPT-6 Astra 模型并陆续向付费用户和 API 开放,基准测试表现亮眼且定价对标竞品。

AI 深度解读

OpenAI 于 2026 年 9 月 3 日推出新模型 GPT-6 Astra 并公布基准测试与定价,展示了其在安全测试与长上下文处理等维度的性能表现与市场定价策略。

  • 计费标准定为输入每百万 token 10 美元、输出每百万 token 50 美元,与 Claude Fable 5 系列定价一致,正逐步向 ChatGPT 付费用户及 API 用户开放。
  • 根据 ARC-AGI 博客 2026 年 9 月 3 日记录,该模型配合专用适配套件在 ARC-AGI 3 测试中取得 99.9% 的成绩(花费约 1.9 万美元),但在默认测试套件下得分为 62.7%(花费约 2.6 万美元)。
  • 安全基准测试中,Astra 在 ExploitBench 达到 100%、ExploitGym 达到 42.4%,在 512K 至 1M 的长上下文八针寻回测试中得分为 96.3%。
  • 第三方机构 Artificial Analysis 评估显示其智力指数得分为 61,与 GPT-5.6 Sol 持平,低于 Claude Fable 5.1。
  • 影响/看点:若专用适配架构能有效降低复杂长推理的复用成本,Astra 或在特定安全与代码工程场景提升成本效益,但其实际表现仍取决于不同任务下基准复现度与长推理调用的经济性。
  • 资料依据:
  • Simon Willison 博客(2026-09-03):https://simonwillison.net/2026/Sep/3/gpt6-astra/
  • ARC Prize 博客(2026-09-03):https://arcprize.org/blog/astra
  • OpenAI 官方公告(2026-09-03):https://openai.com/index/gpt-6-astra/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手