Kimi K3 网络攻击能力远逊美国前沿模型,或与蒸馏 Anthropic 模型有关

📡 The Decoder2026-07-24 17:48

英美AI安全机构测试显示Kimi K3网络攻击能力远逊美国顶尖模型,疑与蒸馏Anthropic模型有关。

AI 深度解读

英美两国AI安全机构联手测试发现,月之暗面Kimi K3在网络攻击相关能力上大幅落后美国前沿模型,这一反常差距恰好印证了此前关于其蒸馏Anthropic模型的质疑。

  • 测试机构:英国AI安全研究院与美国AI标准与创新中心联合测试Kimi K3执行攻击性网络任务的能力
  • 差距悬殊:Kimi K3在ExploitBench基准上仅得32分,而美国领先模型得分高达76分,差距超过一倍
  • 防护失效:Kimi K3的安全护栏未能有效拦截漏洞开发和模拟攻击类请求,说明能力偏弱不等于更安全
  • 疑点浮现:该模型在通用基准测试上表现强劲,却在网络安全这类专项能力上明显偏科,与外界此前对其蒸馏Anthropic模型的猜测相吻合
  • 方法论意义:测试结果说明单靠通用榜单难以评估模型真实能力,专项测试才能暴露训练路径留下的痕迹
  • 如果蒸馏猜测成立,意味着靠「抄近道」训出的模型会在未被针对性优化的能力维度上露出破绽,这也给开源模型的能力审计和溯源提出了新的方法论要求。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com