Anthropic 发布安全报告:揭露 Claude 被滥用及多厂商数据蒸馏行为
Anthropic发布安全报告,揭露Claude被滥用于武器系统与监控,以及多家机构的数据蒸馏行为。
AI 深度解读
Anthropic 于 2026 年 9 月 10 日发布威胁情报报告,披露了过去 8 个月中 Claude 模型遭遇的多起未授权数据提取与高风险滥用行为。
- 报告指出多家 AI 研发团队存在大规模违规数据蒸馏行为,指控阿里 Qwen 团队涉及逾 1.51 亿次交互提取数据,DeepSeek 及月之暗面亦存在类似请求中继或数据提取行为。
- 记录了外部人员尝试利用 Claude 编写导弹制导与控制软件、自主自杀式无人机群攻击代码等常规武器开发案例。
- 披露了利用大模型参与构建监控数千万 SIM 卡的国家级监控系统等违规项目。
- Anthropic 表示已对涉事账户采取封禁措施,上线了新的风险检测机制,并向监管部门和同业通报相关情报。
- 影响/看点在于前沿大模型在知识产权保护与高危军事滥用防范上正面临更复杂的对抗,这意味着模型厂商可能进一步收紧 API 调用风控与审计规则,并加速推动行业安全监管标准的落地。
- 资料依据:
- Anthropic(2026-09-10):https://www.anthropic.com/news/detecting-and-countering-misuse-of-ai-september-2026
- The Decoder(2026-09-11):https://the-decoder.com/how-hackers-used-claude-for-missiles-drone-swarms-and-surveillance-while-chinese-labs-mined-it-for-training-data/
本内容由 AI 生成,仅供参考,请注意甄别