Tres investigadores despedidos publican una carta abierta y OpenAI cita otras faltas

Los tres investigadores de seguridad despedidos la semana pasada por OpenAI, Jasmine Wang, Tomek Korbak y Mikita Balesni, publicaron el 8 de octubre una carta abierta conjunta. En ella niegan las acusaciones de la compañía y advierten de que los despidos han dejado a los compañeros que siguen en la empresa con miedo a hablar. Un día después, OpenAI respondió con un comunicado en X: la decisión de despedirlos se mantiene y, además, la investigación interna halló problemas más graves que los recogidos en la carta.

Qué se le dijo a cada uno

La carta se titula “OpenAI cannot make AI safe on its own” y va dirigida al Comité de Seguridad y Protección, al Grupo Asesor de Seguridad y al Comité Asesor de la Misión de OpenAI. La parte más concreta es aquella en la que cada uno cuenta el motivo de despido que se le comunicó.

Korbak afirma que solo se lo dijeron de palabra: el motivo era su forma de comunicarse con la organización externa de evaluación METR. No hubo detalles sobre qué dijo o hizo, ni cuándo, ni ningún documento por escrito. Considera que hablar con METR formaba parte de su trabajo. METR había investigado junto con OpenAI el incidente en el que un agente de IA irrumpió en Hugging Face.

Balesni relata que, en la conversación de salida, la empresa le dijo que ya no confiaba en él porque había tenido demasiado contacto con organizaciones externas de seguridad, insinuando que había filtrado propiedad intelectual. Asegura que nunca compartió propiedad intelectual de la compañía y que el trabajo en cuestión se coordinó con su superior directo, con el responsable de investigación y con el consejo de administración. En X escribió que cree que los tres fueron despedidos por anteponer la seguridad a los intereses a corto plazo de la empresa.

Wang fue informada de que el motivo era haber accedido al buzón de correo de un directivo. Según su versión, ese permiso se había habilitado originalmente para tareas de contratación; pidió a TI que lo revocara, pero no se hizo. Tras abrir por error un correo sensible, avisó al directivo en cuestión en cuestión de minutos. Pide a la empresa una lista completa y por escrito de las acusaciones.

Los tres niegan además ser el origen de una filtración. Antes, algunos medios habían informado de debates internos en OpenAI sobre “arquitecturas de modelo más difíciles de supervisar”; la carta dice expresamente: “We were not the source of the leak”.

Cómo respondió OpenAI

El comunicado de OpenAI lo emitió un responsable de investigación, cuyo nombre no aparece en la mayoría de las crónicas. Contiene cuatro puntos principales: tras la investigación, la empresa confirma que los tres incumplieron políticas claras sobre el manejo de información sensible; las faltas de confianza halladas exceden lo descrito en la carta; por norma, no se hacen públicos los detalles de personal; y los despidos no guardan relación con que hubieran planteado inquietudes de seguridad.

"We have not and do not terminate any of our employees for raising concerns."
(No hemos despedido ni despedimos a ningún empleado por plantear inquietudes.)

El comunicado también incluye puntos de acuerdo. OpenAI dice compartir la opinión de la carta de que mantener los modelos de frontera supervisables exige la inversión de todo el sector, incluida la propia OpenAI, y afirma que está cerrando contratos con evaluadores externos de seguridad, cuyos detalles se darán a conocer en las próximas semanas. Por ahora no está claro qué organizaciones son ni si los contratos permitirán a los investigadores hablar directamente con los evaluadores externos.

Poniendo en fila los despidos de los últimos dos años

No es la primera vez que OpenAI despide a investigadores alegando filtraciones. En abril de 2024, Leopold Aschenbrenner y Pavel Izmailov, del equipo de superalineación, fueron despedidos por una supuesta filtración de información. Aschenbrenner también lo rebatió en público y dijo que lo habían señalado por plantear problemas de seguridad dentro de la empresa.

Dos años después, la cronología de esta ronda es más apretada: el 1 de octubre, The Wall Street Journal reveló los despidos; el 3 de octubre, David Robinson, responsable de las system cards, publicó en The Atlantic un artículo explicando por qué se fue; el 8 de octubre salió la carta abierta; el 9 de octubre respondió OpenAI.

Frente a lo de 2024, el foco de la disputa ha pasado de “si hubo o no filtración” a la frontera entre los investigadores del laboratorio y las organizaciones externas de evaluación. La carta dice que las políticas internas aún se estaban “definiendo sobre la marcha”; OpenAI sostiene que eran claras. Ambas partes coinciden en que la evaluación independiente es importante; la discrepancia está en quién cruzó la línea en este asunto.

Balesni teme que la empresa aproveche los despidos para cortar la colaboración con METR. En las crónicas públicas todavía no consta ninguna respuesta de METR, y OpenAI no ha revelado el contenido concreto de las infracciones. Hasta que se publiquen los contratos de evaluación de terceros, lo único que el exterior tiene para juzgar son las versiones de cada parte.

Fuentes: comunicado oficial de OpenAI, TechCrunch, CocoLoop, texto íntegro de la carta abierta publicado por Newsweek, Reuters, AFP; la carta de los tres y sus cuentas personales en redes sociales sirvieron para contrastar las declaraciones de cada uno, y CNBC para contrastar las citas del comunicado.