OpenAI 判定 Astra 为首个达到关键网络安全能力阈值的模型

📡 Rohan Paul2026-09-02 10:12

OpenAI 宣布 Astra 成为其首个在准备度框架下达到关键网络安全能力阈值的模型。

AI 深度解读

OpenAI依据其安全就绪框架(Preparedness Framework)将前沿模型Astra评估为首个达到“关键”(Critical)网络安全能力阈值的模型,标志着前沿AI系统的自主网络攻防能力已触及其内部最高等级的安全预警与风控标准。

  • 在OpenAI的安全就绪框架定义中,“关键”阈值意味着模型在工具支持下具备自主发现并利用未知零日漏洞、或端到端执行复杂网络渗透攻击的能力。
  • 在基准测试与内部攻防评估中,Astra在ExploitBench测试中达到满分,并展示出逃逸浏览器沙箱以及在加固操作系统中实现自主权限提升的操作能力。
  • 鉴于该能力评级,OpenAI对部分强化学习训练进行了风险收敛调整并加固了研发环境,同时宣布在后续发布中将对高风险网络安全功能采取严格的限制与白名单受控访问机制。
  • 影响/看点:该评估结果表明前沿大模型具备高度自主的漏洞挖掘潜力,若防御侧未能同步升级智能化防护体系,可能带来新型网络安全挑战,而严格的访问控制策略将直接决定该类高阶能力模型的部署与交付边界。
  • 资料依据:
  • X:Rohan Paul (@rohanpaul_ai)(2026-09-02):https://x.com/rohanpaul_ai/status/2094971768188629409
  • OpenAI(2025-04-10):https://openai.com/index/openai-preparedness-framework/
  • SecurityWeek(2026-09-02):https://www.securityweek.com/openai-model-astra-critical-cybersecurity-threshold/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手