用 Claude 发现密码学缺陷:Anthropic 研究团队分享攻关提示词

📡 Simon Willison 博客2026-07-29 06:45

Anthropic研究团队公开用Claude发现HAWK和弱化版AES密码学缺陷的具体攻关提示词。

AI 深度解读

Anthropic 研究团队公开了一篇文章,记录了他们如何用内部代号“Claude Mythos”的模型在密码学领域发现真实的数学缺陷——包括 HAWK 签名方案和一个弱化版 AES 的漏洞,文章强调这两个发现对当前实际使用的计算机系统都没有实际影响,真正的看点是团队公开的攻关提示词原文,连拼写错误都原样保留。

  • 提示词显示,模型一开始的默认反应是“这不可能做到”,团队需要持续地正向鼓励和引导才能让它真正投入尝试
  • 研究人员反复在提示词里强调目标不是凑数或挑软柿子(比如刻意回避简化版 AES-128 r7),而是要找到真正“值得发表”的、有难度的新发现
  • Mythos Preview 前后连续工作了60个小时,估算 API 成本约10万美元,期间人类介入的主要工作就是不断鼓励模型不要放弃
  • 项目附带的 GitHub 仓库公开了完整的实验过程,便于同行复现和审视方法论
  • 这篇文章比起“AI 发现了密码学漏洞”这个结论本身,更大的价值在于示范了如何用高强度的提示词工程把大模型从“默认放弃”驱动到“做出可发表的原创研究”,为 AI 辅助科研的提示方法论提供了少见的一手样本。

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com