Anthropic 红队评测曝光:前沿模型已跨越二进制漏洞利用的自主利用门槛

📡 Simon Willison 博客2026-09-30 06:20

Anthropic 红队评测指出,GLM-5.3 与 Claude Mythos 展现出自主控制流劫持能力,模型跨越二进制漏洞利用门槛。

AI 深度解读

Anthropic 前沿红队与研究人员于 2026 年 9 月 29 日披露的前沿模型安全评测显示,新一代前沿大模型已具备自主构建二进制漏洞利用代码的能力,跨越了底层安全攻防的自动化门槛。

  • Anthropic 前沿红队在 100 项二进制漏洞利用基准测试中发现,新模型展现出自主实现完整控制流劫持的能力。
  • 评测数据显示 Claude Mythos Preview 达到 6% 的成功率,智谱 GLM-5.3 达到 4%,而早期模型如 Claude Opus 4.6 与 GLM-5.2 成功率均为 0%。
  • 研究表明先进模型在底层系统级安全对抗能力上发生了质的跃迁,打破了过往模型无法自主利用此类高危漏洞的界限。
  • 影响/看点:这表明先进模型的系统攻防能力正在加速扩散,意味着防御方亟需在二进制审计与自动化漏洞修补中引入同等水平的对抗性安全防范机制。
  • 资料依据:
  • Anthropic Research(2026-09-29):https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
  • Simon Willison 博客(2026-09-29):https://simonwillison.net/2026/Sep/29/anthropic-frontier-red-team/

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com →
AI 助手