安全研究员使用 Claude 成功渗透 OpenAI 员工账户发现安全漏洞

📡 Ars Technica AI2026-09-18 21:30

安全研究员借助 Anthropic 的 Claude 工具成功渗透 OpenAI 员工账户,协助其在漏洞被恶意利用前完成排查。

AI 深度解读

网络安全研究团队利用 Anthropic 旗下安全测试工具中的 Claude 模型,在授权测试中成功渗透了 OpenAI 员工账户。

  • 该研究团队参与了漏洞赏金与先验安全防御计划,获得 Anthropic 专门面向安全专业人员的工具访问权限以排查潜在利用链。
  • 研究人员借助 Claude 识别防御弱点并取得了一名 OpenAI 员工 ChatGPT 账户的访问权限,进而读取了内部软件信息并提出修改建议。
  • 这一事件表明前沿 AI 模型在自动化红队渗透与权限提升方面展现出较强实操能力,同时也凸显了头部 AI 企业内部凭据与访问控制面临的常态化安全挑战。
  • 影响/看点:高阶大模型被直接用于攻防对抗,意味着企业不仅需要防范传统网络入侵,还需加快部署针对智能体自动化渗透的防御与权限隔离策略。
  • 资料依据:
  • Ars Technica(2026-09-18):https://arstechnica.com/ai/2026/09/researchers-used-claude-to-hack-openai/
  • Anthropic 安全红队研究通报(2026-09-18):https://www.anthropic.com/research/security-agent-penetration-testing

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手