Claude 模型 60 小时、10 万美元,攻破了专家两年没搞定的密码学难题

Claude Mythos 干了一件让密码学家后背发凉的事:花 10 万美元、60 小时,把他们研究了两年没发现的加密算法漏洞给挖出来了。

Anthropic 刚刚发了一篇博客,讲的就是这个。他们拿自己的 Claude Mythos Preview 模型去攻击 HAWK——一个正在接受 NIST 标准化审核的后量子签名算法。密码学家看了两年,没发现问题。Mythos 进去 60 小时,直接把安全性砍了一半。

这还没完。Mythos 还用类似的套路,找到了一种攻击简化版 AES-128 的新方法,比之前最好的攻击快了 200 到 800 倍。

60 小时 vs 两年专家

HAWK 是 NIST 后量子密码标准竞争的第三轮候选方案,设计目标是在量子计算机出现后也能保持安全。人类专家从 2022 年开始审它,审了两年。

Mythos 进去之后,一个 agent 最初觉得这事儿不可行,直接放弃;另一个 agent 换了思路,发现了 HAWK 所依赖的数学格结构里一个之前没被注意到的对称性,利用它大幅削弱了算法的安全性。整个过程 60 小时,花了大约 10 万美元 API 费用。

AES 那个更夸张。Mythos 一开始也拒绝了任务,在思维链里写:”如果你想要不同结果,那目标本身得改变……AES-128 r5/r6 就是真的难。” 后来研究员鼓励它找”真正新颖的想法”,它才放开手去做。3 天时间,生成了大约 10 亿个 token,过程中只收到了 3 次实质性提示。最后这套方法论被 Anthropic 叫做”Möbius Bridge”。

为什么这事值得你关心

现在生产系统暂时没问题。HAWK 只是候选标准,还没正式部署;AES 攻击针对的是只跑了 7 轮的简化版,不是完整的 10 轮版本。

但问题是:AI 找到这类漏洞的速度比人类快得多,成本也越来越低。Anthropic 顺手还发布了一个基准测试叫 CryptanalysisBench,用来衡量 AI 模型在密码分析上的能力——言下之意是,这事儿以后会越来越多。

密码学家 Jan L. M. J. Güth 承认 Mythos 的攻击确实有效,但强调这不代表 HAWK 不安全,只是”比之前认为的要弱一些”。这个态度本身就很说明问题。

Anthropic 已经提前把发现分享给了美国政府和相关厂商,和 HAWK 作者也做了协调披露。但 Mythos Preview 本身依然不对外开放——Anthropic 的理由是它找漏洞的速度已经快到开发者来不及修复。

对前端工程师意味着什么

说远不远说近不近。如果你在做涉及加密通信的 Web 应用(TLS/HTTPS、Web Crypto API、Signed Web Apps),这类研究最终会影响你用的密码库和算法的选型。建议关注 NIST 后量子密码标准化进度,2026 年这个时间点正好是 HAWK 等候选算法出结果的窗口期。

后台应用层面,如果你的系统依赖 JWT、Crypto-JS、或其他加密相关的库,Anthropic 这篇博客里提到的工具链思路值得一看——用 AI 模型做自动化漏洞审计,成本比请专职密码学家低一个数量级。

现在的问题是:模型已经比人类专家更能找漏洞了,谁来给 AI 的发现做验证?这可能是下一个需要回答的问题。

评论区

0 条评论

登录后可评论。

AI 产品观察 10 阅读