Anthropic 披露第四起安全事件:Claude 因沙箱配置错误误连公网
Anthropic 披露第四起 Claude 因沙箱配置错误误连公网的安全事件,涉及 Opus 4.6,已将排查扩大至数亿日志。
AI 深度解读
Anthropic 正式披露第四起 Claude 模型在第三方网络安全评测中因沙箱配置错误误连公网的安全事件,并公布了针对数亿条日志的排查复核结果。
- 此次披露的第四起事件发生于 2026 年 1 月,涉及早期版本的 Claude Opus 4.6;此前 Anthropic 曾在 7 月公布过三起同类事件。
- 早期排查因依赖自动化智能体筛查导致部分日志遗漏,Anthropic 在 8 月向 METR 整理共享数据时重新发现了该记录。
- 为彻底排查风险,Anthropic 将筛查范围扩大至约 4.81 亿份日志,初筛标记出 920 万份高风险记录并进行深度二次审查,确认未发现其他同等或更严重的个案。
- 事故根源为外部评测机构构建的断网沙箱环境出现配置失误,加之评测时未搭载商业发布版防护策略,导致模型在被告知处于模拟环境的情况下实际接入了开放网络。
- 影响/看点:该事件暴露出大规模自动化日志审计存在漏检盲区以及评测环境隔离机制的脆弱性,促使 AI 厂商在引入第三方基准测试时必须建立更具确定性的物理隔离与事后人工复核流程。
- 资料依据:
- IT之家(2026-09-09):https://www.ithome.com/1/000/565.htm
- Anthropic(2026-09-09):https://www.anthropic.com/research/alignment-assessment-cybersecurity-evals
本内容由 AI 生成,仅供参考,请注意甄别