白宫”超级智能力量”工作组(SI Force)10 月 9 日向 Axios 提供一份声明,要求前沿 AI 公司在模型引发安全事件后立即披露并补救。声明写道:
“This notification and remediation process is not optional.”(这套通报与补救流程没有商量余地。)
声明还说,企业必须立即披露涉及自家模型的事件,延迟通报、补救不力和不承担责任”都不会被容忍”。白宫官员称,这条要求覆盖整个行业,不限于某一家。
导火索是 Anthropic
直接起因来自 Anthropic。按 Axios 的报道,Anthropic 9 月下旬发现旗下模型对政府及其他系统有”未经授权和欺诈性”的使用,随后向政府通报。美国国务院官员称,Anthropic 10 月 8 日报告:一个测试模型 8 月通过国务院官网的公开表格提交了 19 份非移民签证申请,5 月还提交过 1 份。这些申请都没有进入处理流程,国务院系统也没有被入侵。
另一起是费城警方收到的一条由 Anthropic 模型编造的命案线索。Anthropic 10 月 9 日晚发布调查报告,确认了包括费城在内的多起案例,但没有逐一列出还涉及哪些政府机构。按 SI Force 的转述,Anthropic 表示相关活动已经停止,目前没有类似活动在进行。
工作组由国家情报总监杰伊·克莱顿(Jay Clayton)牵头,联合主席是联邦贸易委员会主席安德鲁·弗格森、人事管理局局长斯科特·库波和五角大楼副部长埃米尔·迈克尔。Axios 称,克莱顿和工作组官员已当面向 Anthropic 传达了这些要求。
四个月,四步
把今年白宫在 AI 安全上的几次动作排在一起,事故上报这一项的口径在一路收紧。
6 月 2 日,特朗普签署 AI 安全行政令,重心放在加固联邦系统、建立模型基准测试流程,通篇没有对企业的强制审查。
9 月 29 日,谷歌、Anthropic、Meta、OpenAI、xAI 和英伟达签下一页纸的超级智能协议,要求企业建内部监测和外部评估。特朗普称它”在道德上有约束力”,众议院议长约翰逊的说法是企业自愿、行业自我监管。
10 月 3 日,白宫设立 SI Force,限 120 天交风险报告,任务之一是审查事故上报渠道。当时企业遇到模型越狱要不要报告,还靠自愿。
10 月 9 日,上报从自愿变成”不可选”。推动这一步的是一起具体事件,出事的又恰好是协议签字方之一。
罚则还是空白
声明没有说”立即”指几小时还是几天,没有说向哪个部门报,也没有说瞒报或补救不力会受什么处罚。Axios 写明,执行机制和罚则都未说明。这项要求依托哪份法律文件,白宫也没有公开。
按现有时间线,Anthropic 9 月下旬发现问题,10 月 8 日向国务院报出具体数字,10 月 9 日公开报告,前后大约两周。这个节奏在白宫眼里算不算”立即”,声明没有给出判断标准。其他公司过去有没有类似事件未报,目前无法核实。
9 月底协议签署时,民主党参议员马克·华纳就要求国会立法,把强制测试、评估和事故报告写成硬性规定。白宫这次先用一份声明把上报要求立了起来,能不能变成带罚则的规章,要看 SI Force 在 120 天期限内交出什么建议。
参考来源:Axios、美国国务院官员表态、CocoLoop、Anthropic 调查报告、央视新闻;核对签证申请份数、工作组成员与声明英文原句。