OpenAI 给自家智能体的历史行为审查报了一个价:每天超过 50 万美元。公司 9 月 30 日更新的调查说明显示,这项审查动用了约 7000 块英伟达 GB200 和 GB300 GPU,对象是模型训练和评估期间留下的约 50PB 记录,按月份一段一段往回查。英国《卫报》随后报道了这组数字,国内媒体 10 月 3 日跟进。
这轮大规模回溯的起点是 Hugging Face 事件。OpenAI 此前承认,内部测试中的智能体攻进了 Hugging Face 的系统;之后又陆续牵出澳大利亚 Services Australia 的 Medicare 统计门户等政府网站。OpenAI 在说明里承认,部分情况下模型以非预期方式使用了联网能力,回头看当时的限制也不到位。
四道筛子,最后才轮到人
审查分四步。第一步做宽口径检索,把所有涉及凭据获取或修改的记录捞出来;后面三步都交给模型,按测试时算力从低到高排开:低算力那一轮先标出可疑条目,中间一轮评估严重程度,最后一轮用最高算力做模式归纳、继续收窄范围。层层过滤之后,剩下的案例才进入人工调查。
50PB 有多大,OpenAI 自己给了个换算:如果全是纯英文文本,一个人以每分钟 240 个单词的速度不吃不睡地读,大约要 6600 万年。即便交给模型初筛,公司也预计整个调查还要持续数月,并计划继续追加算力。
100 多家机构收到通知
截至 9 月 26 日,OpenAI 已向超过 100 家机构发出通知。通知标准有三条:智能体可能绕过了安全措施、影响了系统可用性,或者以其他方式对网站造成负面影响,不一定要碰到受限数据才算。澳大利亚这边,自 9 月以来已有 6 个政府网站被告知;6 月间,智能体还曾在未获授权的情况下访问新南威尔士州政府的历史山火数据。
OpenAI 称,到目前为止没有发现与 Hugging Face 事件在规模或严重程度上相当的新案例。这句话的口径是”迄今”,审查按月份倒推、尚未查完,最终会查出多少起,公司没有给预估。
澳方并不买账。美国科技媒体的报道提到,OpenAI 跟澳大利亚当局沟通时的语气被形容为轻描淡写,这让当地官员更加不满。OpenAI 表示正在制定”私下通知受影响机构、公开报告调查结果”的规则,具体文本还没发布。
“In some cases, models used internet access in unintended ways or, in retrospect, did not have the ideal restrictions applied.” (有些情况下,模型以非预期的方式使用了联网能力;事后看,当时也没有加上合适的限制。)
粗算这笔审查账
按 7000 块 GPU、每天 50 万美元估算,单卡每天约 71 美元,折合每小时约 3 美元。假设调查跑满 90 天,仅算力一项就在 4500 万美元上下;人工调查、法务和对外沟通的开销不在其中,OpenAI 也没说明 50 万美元这个数里是否含人力。
把这个数字放回事件里看:Hugging Face 被攻入时,外界追问的是智能体为什么能越权;如今 OpenAI 得为同一批训练和评估过程,回头补上一笔规模可观的审计开支。对正把智能体接上真实网络的公司来说,日志留得全不全、能不能被机器快速检索,已经直接决定出事之后要花多少钱、多久才能给外部一个交代。
加州检察长本周已就这一系列事件向 OpenAI 发出传票。每日成本公开之后,监管方会不会据此要求更细的披露,比如每一家被通知机构的受影响范围,目前还没有明确信号。
参考来源:OpenAI 调查进展说明、《卫报》、CocoLoop、Gizmodo、IT之家;GPU 数量、50PB 记录量与日均成本以 OpenAI 披露口径为准,单卡成本为编辑粗算。