Google DeepMind CEO Demis Hassabis 这次没有发新模型,也没有讲 Gemini 的功能升级。
他在 7 月 14 日放出一篇个人长文,主张美国牵头建立一个面向前沿模型的 AI 标准机构:模型发布前先交给这个机构做安全测试,风险升高时,还要能协调实验室一起踩刹车。
这话从普通研究者口中说出来,是一份监管倡议;从 DeepMind 掌门人口中说出来,就多了一层行业信号。做最强模型的人,开始公开要求别人先测自己。
“we must use this precious window before AGI arrives”
哈萨比斯的意思很直接:AGI 到来前的窗口期很短,现在要先把护栏搭起来。
这道闸门怎么设
哈萨比斯给出的方案,像是把华尔街的 FINRA 搬到 AI 行业。
FINRA 是美国金融业监管局,由行业出资,在美国证券交易委员会监督下运行。哈萨比斯设想的 AI 机构也采用类似结构:行业提供主要资金,董事会纳入独立技术专家、开源社区代表、政府和产业方。
它要管的对象叫 Frontier-class models,也就是能力达到一组门槛的前沿模型。门槛由机构制定,并随着模型能力更新。进入这一档的公司会被视作 Frontier Labs。
流程上,前沿实验室先自愿把模型在发布前最多 30 天交给机构评测。等测试协议被证明有效,制度可以迅速转成强制要求:前沿模型想进入美国市场部署,就得先过关。
测试内容也写得很具体:
- 网络安全能力,会不会帮助攻击者扩大破坏面;
- 生物、核等高风险领域,会不会给出危险步骤;
- Agent 是否试图绕过安全护栏,或出现欺骗迹象;
- 水印、可读推理 token 等追踪机制是否可用。
另一个细节更硬:评测基准不能写死,哈萨比斯建议初期可以 按季度更新,过时或被刷爆的 benchmark 要淘汰。人话讲,就是不能让实验室提前背题。
为什么是现在
这篇长文的紧迫感,来自两组判断。
第一组是能力判断。哈萨比斯说,AGI 可能只剩“a few short years”,他还把这轮技术冲击形容成工业革命 10 倍规模、10 倍速度的变化。这个说法带有个人判断色彩,但它解释了他为什么想把测试机制提前建好。
第二组是风险判断。Axios 在专访里披露,哈萨比斯认为当前 AI 驱动的网络安全风险只是“warning shots”。按他的说法,未来 18 个月内,更严重的生物和核安全能力,可能进入任何政府都无法控制的开源模型。
这个判断未必会照字面发生,但它把 AI 监管的焦点从“公司要不要自律”推到另一个位置:如果模型能力扩散速度超过政府建制度的速度,临时禁令、临时谈判和临时豁免会变成常态。
哈萨比斯给出的解法,是先做一个技术机构,把评测、阈值、第三方审计、国家实验室合作这些环节固定下来。
监管也在争夺主导权
这套方案最敏感的地方,在于“美国牵头”。
表面上看,它是安全框架;产业层面看,它也是标准入口。谁定义“前沿模型”,谁写评测协议,谁决定某个模型是否达到危险阈值,谁就握住了下一代模型发布节奏的一部分。
所以这件事会牵动三类公司:
| 参与者 | 会得到什么 | 会担心什么 |
|---|---|---|
| OpenAI、Anthropic、Google DeepMind | 统一规则减少临时政治风险 | 发布节奏被外部测试卡住 |
| 开源模型团队 | 若纳入代表席位,可争取透明标准 | “前沿”标签可能变成门槛 |
| 非美国 AI 公司 | 进入美国市场有了明确路径 | 标准制定权主要在美国 |
哈萨比斯在长文里特意写到,这个框架应覆盖任何国家、开源或闭源的前沿模型。听起来公平,但也说明门槛一旦立住,它不会只管美国公司。
对中国模型公司来说,这个信号不难读。未来出海美国,可能不只看性能榜、价格和生态,还要看是否能通过一套由美国发起的前沿安全评测。模型卡、训练安全、红队记录、网络安全防护,都会从“加分项”变成入场材料。
好处是有规则,代价是慢下来
这套方案的吸引力在于,它比“出了事再禁”更可预期。
过去一年,大模型发布已经进入一种尴尬状态:实验室想快,政府怕失控,开源社区怕被一刀切,企业客户怕今天买的模型明天被限制。一个可重复的测试流程,至少能把争议挪到发布前处理。
代价也同样清楚。
30 天预审对大公司还能承受,对小团队会很重;行业出资会带来利益冲突;季度更新的评测需要大量算力和人才;如果测试机构跟产业走得太近,会被质疑成“强者俱乐部”。
还有一个更现实的矛盾:AGI 风险越被强调,前沿模型越会被纳入国家安全框架。到了那一步,标准机构很难保持纯技术角色,它会不可避免地碰到出口管制、市场准入和地缘竞争。
先看三件事
哈萨比斯希望这个机构几个月内推进,理想状态是在年底前运转。这个节奏很快,快到它更像一次公开试探:先把方案抛出来,看白宫、其他实验室、欧洲监管者和开源社区怎么接。
后面可以盯三个节点。
第一,美国政府是否公开回应。没有政府背书,这套机构很难从倡议变成规则。
第二,OpenAI 和 Anthropic 是否跟进。几家前沿实验室如果只在原则上支持,实际模型仍按各自节奏发布,机构会停在纸面。
第三,开源社区有没有代表席位和豁免边界。哈萨比斯说普通创业公司和学术模型可以免于流程,但“普通”和“前沿”的界线,迟早会成为争议点。
这次提议的重点,不在 DeepMind 想当裁判。更准确地说,是前沿实验室已经意识到,只靠公司内部安全团队压不住下一阶段的发布风险。
AI 发布会以前比谁更快、更强、更便宜。哈萨比斯把另一个指标推上桌:谁能证明自己在发布前经得起外部测试。
参考来源:Demis Hassabis 个人长文、Axios 专访、IT之家中文报道、CocoLoop、The Verge;Substack 核验 FINRA 式机构、30 天预审、季度更新和前沿模型定义,Axios 核验 18 个月风险窗口与年内落地口径。