今年春天,美国军方在中东差一点登临一艘中国货船。武装人员已经就位,军机已经升空,行动在最后阶段被叫停。叫停的理由是,官员回头细看支撑这次拦截的情报报告时,发现它由人工智能协助生成,而报告里认定的那批货物并不存在。
CNN 在 9 月 18 日披露了这起事件,消息来自多名了解内情的人士。多家媒体随后跟进,核心事实一致:一份 AI 参与制作的情报产品,走完了从起草到决策的完整链条。
两次调用,一份报告
报告出自美国太平洋特种作战司令部的一名分析员,该司令部设在夏威夷。这名分析员先用一个聊天机器人核对涉事船只的货物清单,工具把公开渠道的信息和敏感情报数据库里的条目混在一起给出结论;随后他又用 AI 起草了那份格式化的情报报告。两个环节叠加,最后呈到决策链上的文件称,船上装着运往伊朗核计划的相关部件。
这份报告是在美国与伊朗交战期间流转的。按照规定动作,这样的情报指向一次海上拦截:让武装人员登船查验。飞机已经在空中盘旋。一名军方消息人士对 CNN 的说法是,这份报告”完全虚假,却几乎引发了一场战争”。
“entirely false, but almost started a war” 完全虚假,却几乎引发了一场战争。
行动最终没有执行。官员在计划落地之前做了一次更细的复核,才发现报告的 AI 来源和工具对货物的误判。CNN 的报道没有说明这艘船实际装的是什么、开往哪里,也没有点出分析员用的是哪一款聊天机器人。美国中央司令部没有回应置评请求。
工具被放进了哪一环
这起事件里没有出现越狱,没有对抗性攻击,也没有黑客。出问题的是一个很常规的用法:拿通用聊天机器人做信息归并。它把开源信息和涉密库里的条目拼到一起,得出一个听起来完整、格式也标准的判断,而这个判断在链条下游被当作核查过的事实使用。AI 起草的第二步又给它加了一层可信外观,一份读起来像人写的、符合规范的情报产品。
情报流程里本来有多道人工签发环节。这次拦截之所以没有发生,靠的是行动前临时做的一次细看,不是流程里预设的审核关卡。如果那次复核没做,或者做得稍微粗一点,这份文件会按原样走完。
这条误判落在谁身上
被瞄准的是一艘中国船。如果登船真的发生,后果由船员、船东和两国的危机处置机制承担,不由写报告的分析员或提供工具的厂商承担。技术风险发生在美国的流程内部,代价却出现在流程之外。中方目前没有就这起事件公开表态,报道中也没有出现中国方面被知会的记录。
对跑中东航线的中国航运公司来说,“美军依据什么判断我这条船有问题”这个答案的性质正在变化:从人工签发的情报判断,变成一份可能经过两道 AI 中转的文书。哪一层可以申诉、错了由谁纠正,目前没有公开的机制可查。
建议停在建议层面
把 AI 装进情报分析、目标判定和后勤流程,这件事本身没有被这起事故打断。公开报道提到的专家建议包括两项:给核相关系统划出 AI 不得介入的红线,以及在大国之间建立类似核热线的 AI 事故通报渠道。两项都还停留在建议层面,没有进入任何具备约束力的文件。
从公开信息看,目前还没有哪个环节被正式改掉。美国中央司令部没有说明是否已经调整分析员使用通用 AI 工具的规定,也没有说明这份报告之外,还有多少份文件走过同样的路径。
参考来源:CNN Politics、Gizmodo、CocoLoop、Taipei Times;事发司令部、AI 两次调用的先后顺序与"完全虚假"一句引语,按多家英文媒体的一致口径核对。