被开除的三名研究员发信,OpenAI称另有失信

上周被 OpenAI 开除的三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni,10 月 8 日联名发出公开信,否认公司对他们的指控,并警告这次开除已经让留在公司的同事不敢说话。一天后,OpenAI 在 X 上发声明回应,坚持开除决定不变,同时称内部调查发现的问题比信里写到的更严重。

三个人各自被告知了什么

公开信标题是“OpenAI cannot make AI safe on its own”,收件方是 OpenAI 的安全与保障委员会、安全顾问小组和使命顾问委员会。信里最具体的部分,是三人分别讲了自己被告知的开除理由。

Korbak 说他只被口头告知,原因是他和外部评估机构 METR 的沟通方式,具体说了什么、做了什么、什么时候,都没有细节,也没有任何书面材料。他认为和 METR 沟通本来就是他的工作。METR 此前与 OpenAI 合作调查了智能体攻入 Hugging Face 的事件。

Balesni 说,离职谈话里公司称因为他和第三方安全机构接触过多而不再信任他,暗示他泄露了知识产权,他表示自己从未分享公司的知识产权,相关工作也和直属上级、研究负责人以及董事会协调过。他在 X 上写道,自己认为三人被开除是因为把安全放在了公司短期利益前面。

Wang 被告知的理由是访问了一位高管的邮箱。她的说法是,这个权限当初是为招聘工作开的,她请 IT 撤销却没被执行;误开一封敏感邮件后,她几分钟内就告诉了那位高管。她要求公司给出书面、完整的指控清单。

三人还否认自己是一起泄密的源头。此前有媒体报道过 OpenAI 内部关于“更难监控的模型架构”的讨论,信里写明“We were not the source of the leak”。

OpenAI 怎么回

OpenAI 的声明由研究负责人发出,具体署名在多数报道中没有出现。要点有四条:调查后确认三人违反了处理敏感信息的明确政策;发现的失信行为超出公开信所述;人事细节按惯例不公开;开除与他们提出安全担忧无关。

“We have not and do not terminate any of our employees for raising concerns.” (我们没有、也不会因为员工提出担忧而开除任何人。)

声明里也有认同的部分。OpenAI 表示同意信中“保持前沿模型可监控性需要全行业投入,包括 OpenAI 自己”的看法,并称正在敲定与第三方安全评估机构的合同,细节会在未来几周公布。哪几家机构、合同里是否允许研究员与外部评估方直接交流,目前都不清楚。

把这两年的几次开除连起来

OpenAI 以泄密为由开除研究人员,这不是第一次。2024 年 4 月,超级对齐团队的 Leopold Aschenbrenner 和 Pavel Izmailov 被以涉嫌泄露信息为由开除,Aschenbrenner 事后同样公开反驳,称自己是因为在内部提安全问题而被针对。

两年后的这一轮,时间线压得更紧:10 月 1 日《华尔街日报》报出三人被开除;10 月 3 日,负责系统卡的 David Robinson 在《大西洋月刊》发文讲自己为何离开;10 月 8 日公开信发出;10 月 9 日 OpenAI 回应。

和 2024 年那次比,这次争议的焦点从“有没有泄密”挪到了实验室研究员与外部评估机构之间的边界。信里说内部政策当时还在“边做边定”,OpenAI 则说政策是明确的。双方都同意独立评估重要,分歧在于这件事上谁越了线。

Balesni 担心公司会借这次开除切断和 METR 的合作关系。公开报道中暂未见到 METR 的回应,OpenAI 也没有披露违规的具体内容。在第三方评估合同公布之前,外界能拿来判断的只有双方各自的说法。

参考来源:OpenAI 官方声明、TechCrunch、CocoLoop、Newsweek 公开信全文、路透社、法新社;三人公开信与个人社交账号核对各自陈述,CNBC 核对声明引语。