AI 安全模型以前像自动化漏洞猎手:读代码、找边界条件、写利用样例。Anthropic 7 月 28 日公布的新结果,把这条线往前推了一步。
Claude Mythos Preview 被用来研究加密算法本体,结果改进了两类攻击:一类针对后量子签名候选方案 HAWK,另一类针对简化版 AES。最容易被误读的地方也在这里:这条新闻不能读成“AI 破解了互联网加密”。Anthropic 反复限定,两个结果目前都没有改变生产系统的安全状态。
新的信号,是 AI 已经能在顶级人类审查过的数学结构里,提出可验证的攻击改进。
HAWK先被打到要加倍
HAWK 是 NIST 后量子数字签名项目第三轮候选方案之一。它的目标,是在量子计算机成熟后继续保护网站认证、软件签名和其他数字签名场景。
Anthropic 披露,HAWK 已经经历两轮、约两年专家审查。Claude Mythos Preview 在 60 小时工作里找到一种改进攻击,等效结果是把 HAWK 的有效密钥强度削掉一半。官方原句写得很直:“Mythos was able to improve the best-known attack on it in just 60 hours of work—effectively cutting its key strength in half.” 中文说法就是,原本以为要用某个强度去打的 HAWK,现在同等安全性需要更大的密钥。
技术论文里给了一个更硬的量级:小规格 HAWK-256 的完整密钥恢复攻击,原先预期成本约为 2^64,Claude 展示的攻击把这一项压到 2^38。这仍属指数复杂度攻击,也未波及其他 NIST 后量子签名候选或整个格密码方向,但足以改变 HAWK 继续作为候选方案的吸引力。
一个人话翻译是:标准化流程本来就要在部署前把候选方案打到疼。AI 做到这一步,说明未来密码标准的“红队审查”会越来越像模型、人类和实验脚手架的联合流程。
AES那条线更像预警
第二个结果指向 AES,但边界必须讲清楚。AES-128 完整版本有 10 轮,Claude 改进的是 7 轮简化版本,也就是学术界常用来研究攻击技巧的 reduced-round cipher。
Anthropic 说,Mythos 在一个 meet-in-the-middle 攻击链里提出了名为 Möbius Bridge 的指纹算法,省掉前人攻击中一处 256 种取值枚举。扣除额外计算开销后,整体运行速度相较先前最强方法提升 200 到 800 倍,具体取决于如何计量运行时。
这里的限制同样很大。旧攻击假设攻击者能请求 2^105 个 chosen plaintexts,这在现实系统里完全不实用;新结果也没有破解完整 AES。Anthropic 的脚注还写到,即便在简化设定下执行这类攻击,成本也可能达到数亿美元级。
所以这条线的新闻价值不在“AES危险了”。它更像一次能力边界提示:如果模型能在 7 轮 AES 上改进长年累积的学术攻击,下一步更该盯住那些审查密度低、部署面却很广的专用密码方案。
模型没有自己变成密码学家
这组结果还有一个不该省略的细节:人类仍在回路里。
HAWK 攻击由一名 Anthropic 研究员和 Claude 一起推进;AES 攻击则由研究员搭脚手架,让 Claude 提假设、跑实验、否定假设,再继续搜索。Anthropic 说,每个主要结果的 API 成本约 10 万美元。AES 方向里,Claude 一周提出想法,研究人员花了近 一个月才对正确性建立信心。
这给了两个判断。第一,AI 正在把发现阶段压缩得很快。第二,验证、披露和责任边界仍然慢,而且会成为瓶颈。
Anthropic 也披露了后续实验:Claude 对 LEA 的 13 轮版本找到可运行攻击,可在现代桌面电脑上用低于 2^30 的加密明文恢复密钥;它还在 Serpent-128 的 6 轮版本、Salsa20、Poseidon 和 SHA-1 上找到不同程度的改进。这些都没有直接影响完整生产算法,但说明搜索范围已经不止 HAWK 和 AES。
这次最该看限制条件
这条新闻很容易被写成惊悚标题,实际更适合看成一次标准化流程的升级。
NIST 的候选算法就是要公开接受攻击。HAWK 被打穿一部分,反而说明部署前审查还有机会拦住弱点。AES 简化版攻击则提醒行业,成熟算法的安全感来自长期公开审查,不来自“大家都这么用”的惯性。
对中文读者来说,最具体的跟进点有三个。第一,NIST 后量子签名项目会不会因此调整 HAWK 的位置。第二,Anthropic 计划公开的后续 LEA、Serpent 等结果,会不会触发更多厂商复核自家密码实现和协议选择。第三,国内模型公司如果也把大模型放进密码分析和安全审查,谁来定义披露节奏、算力访问和可复现实验标准。
Claude 这次没有推倒互联网加密。它把一个更棘手的问题摆出来了:当 AI 找弱点的速度开始超过人类验证和修补的速度,密码学的公开审查流程也要扩容。
参考来源:Anthropic Frontier Red Team、Anthropic HAWK 技术论文、Anthropic AES 技术论文、NIST 后量子签名项目、CocoLoop;核验 HAWK 第三轮候选状态、60 小时攻击发现、2^64 至 2^38 密钥恢复成本变化、AES-128 10 轮与 7 轮口径、200-800 倍攻击加速、2^105 chosen plaintexts 假设、约 10 万美元 API 成本及生产系统影响边界。