也门团队被指用Claude写导弹制导代码

Anthropic 9 月 10 日发布一份威胁情报报告,把 2025 年 12 月到 2026 年 8 月期间查到的 Claude 滥用案例归成七类:网络行动、影响力操控、监控、常规武器开发、生物滥用、诈骗欺诈、非法蒸馏。

常规武器那一类共 6 个案例,按报告给出的归属地分,中国 3 个、俄罗斯 2 个、也门 1 个。写得最细的是也门那一个。

一个单位,三个项目

报告描述的是也门北部一个武器研发单位,同时推进三个项目:一款制导火箭、一款射程超过 2000 公里的多级弹道导弹,以及高超音速滑翔变体系列。

他们用 Claude Code 做的是制导、导航与控制软件,也就是通常写作 GNC 的那一块。具体到活儿上,报告列了四项:写控制与位置估计代码、调参数、构建固件、跑飞行仿真。Anthropic 的原话是,相关人员用 Claude Code 处理了部分原本需要软件工程师完成的工作。

绕过安全机制的手法有两条。一条是隐去软件的军事用途,把需求包装成通用的控制算法问题;另一条是把整套工作拆到彼此独立的会话里,每个会话只看得到一个零件,拼不出完整计划。

把他们暴露出来的是一次失败。报告说,制导火箭有一次试射没成功,操作者回头去问 Claude 失败原因,这个问题触发了安全告警。

Anthropic 的表述是,安全机制拦下了其中很多请求,但不是全部;涉事账户已经永久封禁。

有一处需要说清楚:报告没有点名这个单位属于哪一方。“也门北部”是报告给出的地理描述,胡塞武装这个说法来自媒体的关联推断,Anthropic 没有确认。报告同样写明,没有证据显示这些项目做出了可用的武器。

监控那一类的量级更大

七类里最容易被数字压住的是监控。报告提到马里的一套名为 Lakana 360 的平台,覆盖约 2500 万张 SIM 卡,接入三家全国性移动运营商。这个规模已经超出个别人越界使用的范畴,属于成体系的基础设施。

非法蒸馏那一类的主角是几家中国实验室,阿里那条线的数字是三个月 1.51 亿次交互,报告用“工业规模的秘密行动”来形容这一类。这部分此前已有单独报道。

报告还交代了一个模型侧的口径:被滥用的多是 Claude Opus 4、Sonnet 4.5 这些较旧型号。旧型号的生物类护栏按报告的说法,“主要是防止新手获取已知生物武器的内容”,而新一代的 Fable、Mythos 级模型上了更严的限制,双用途生物研究类的宽泛查询也被收窄。

同一天出的两份东西

9 月 10 日 Anthropic 放出的不止这一份。同日发布的还有前沿红队和威胁情报团队的一份能力评测,测的是模型在军事和情报任务上能做到什么程度,包括照片定位、账号关联、无人机末段制导和 GPS 被干扰时的自主导航。那份报告的结论是,部分任务上模型已经能做到过去只有少数受训专家才能做的事。

两份放在一起看,时间顺序是倒的。能力评测回答的是“能不能做到”,威胁情报报告回答的是“已经有人在做”。后者覆盖的时间窗从 2025 年 12 月起算,比前者的测试早了大半年。

从 Anthropic 过去一年的公开节奏看,这条线是在加密的:从早期零星的账号封禁通报,到墨西哥自来水系统那一类单点事件的披露,再到这次按类别、按归属地整理的年度盘点。至于这种密度的披露会不会成为行业惯例,其他几家目前都没有可比的公开材料。

参考来源:Anthropic 威胁情报报告、CocoLoop、联合新闻网、unwire.hk;核验报告发布节点、案例数量分布与也门项目的三条产品线口径。