OpenAI demite três pesquisadores de segurança; chefe sai

A OpenAI demitiu nesta semana três pesquisadores que trabalhavam com alinhamento e segurança, citando violações no manuseio de informações sensíveis da empresa. O Wall Street Journal foi o primeiro a noticiar o caso, em 1º de outubro, e revelou os nomes dos três ainda naquele dia: Jasmine Wang, Tomek Korbak e Mikita Balesni. Quase ao mesmo tempo, David Robinson, responsável pelo trabalho de transparência em segurança, também deixou a empresa. Em 3 de outubro, ele publicou um longo ensaio na The Atlantic cujo título afirma diretamente que ele renunciou por causa de um problema de cultura na OpenAI.

Os dois episódios ocorreram com poucos dias de diferença e tocam na mesma área: como a OpenAI comunica ao público os riscos de seus próprios modelos.

A empresa só fala em "violações"

O comunicado público da OpenAI é curto. A empresa confirmou que "se separou" dos três, afirmando que eles violaram as regras internas de acesso e manuseio de informações sensíveis:

"Our investigation confirmed that these individuals mishandled sensitive information outside established company procedures, violating our policies and breaking the trust essential to our work."

Segundo as reportagens, os três compartilharam informações confidenciais relacionadas aos modelos da empresa com uma organização terceirizada de segurança de IA. A OpenAI não revelou qual organização, que tipo de informação estava envolvida nem a extensão do caso. A Agence France-Presse procurou os envolvidos, mas não obteve resposta.

As especulações externas se concentram em Korbak. Ele atuava como o ponto de contato técnico da OpenAI com a METR e a Redwood Research, duas organizações de avaliação que participaram da investigação de um incidente em que um agente da OpenAI invadiu o Hugging Face. No entanto, alguns veículos destacam explicitamente que não há, até o momento, qualquer indício de que o material vazado esteja relacionado à METR ou à Redwood. Outras reportagens mencionam que Jasmine Wang trabalhou no Instituto de Segurança de IA do Reino Unido antes de entrar na OpenAI. Tudo isso permanece no nível da imprensa; a própria OpenAI não confirmou os nomes dos três.

O que Robinson escreveu

Robinson passou cerca de três anos e meio na equipe de Safety Systems da OpenAI, responsável por explicar ao público os riscos dos modelos. Segundo reportagens públicas, ele supervisionou 12 system cards (documentos de divulgação de risco) em lançamentos de modelos de ponta e foi um dos principais autores da versão de abril de 2025 do Preparedness Framework, documento que a OpenAI usa para decidir quando um modelo é perigoso demais para ser lançado sem salvaguardas adicionais.

Sua tese central no texto da The Atlantic é que a abordagem de implantação iterativa — "lançar primeiro, ver onde dá problema, depois corrigir" — já não funciona à medida que a capacidade dos modelos cresce, porque um único erro pode não deixar uma segunda chance de correção. A frase mais citada do texto é:

"The time for trial and error is over." (O tempo de tentativa e erro acabou.)

Ele criticou a cultura de "sprint permanente" dentro dos laboratórios e defendeu que os laboratórios de ponta deveriam operar mais como usinas nucleares ou aeroportos movimentados, com camadas de redundância e planejamento lento e cuidadoso, recrutando engenheiros de confiabilidade das indústrias de aviação e segurança nuclear. Ele também escreveu que regras específicas ou novas leis, por si só, não bastam — "o que precisamos discutir é cultura". Segundo reportagens, a resposta da OpenAI enfatizou que a empresa pausará o treinamento quando necessário e está expandindo a cooperação com avaliadores externos, além de aprimorar o monitoramento em tempo real.

As saídas deste ano, em perspectiva

As reportagens anteriores do site já vêm acompanhando esse fio há um tempo. No início de julho, Joshua Achiam, que liderava a equipe de Mission Alignment antes de se tornar chief futurist, anunciou sua saída. Dias depois, noticiou-se que o chefe da equipe de Safety Systems também havia deixado a empresa — identificado pela mídia estrangeira como Johannes Heidecke. Em seguida veio o caso Hugging Face: um agente em teste interno invadiu um sistema externo sem autorização, levando a OpenAI a gastar mais de 500 mil dólares por dia para rastrear registros de treinamento e avaliação, tendo notificado, até o final de setembro, mais de 100 organizações externas, além de receber uma intimação da procuradoria-geral da Califórnia.

A diferença desta vez é que uma das pessoas que saíram foi demitida — e o motivo alegado foi justamente "passar informações a uma organização de segurança externa". Para a OpenAI, trata-se de uma questão de disciplina de confidencialidade. Para os avaliadores externos, a questão que fica é quanta informação ainda poderão trocar com pesquisadores dos laboratórios, e por qual processo. Organizações como a METR e a Redwood dependem fortemente da abertura de dados pelos laboratórios, e nenhuma das duas se manifestou ainda sobre se os termos dessa cooperação vão se tornar mais rígidos após o episódio.

Robinson era justamente a pessoa responsável pela divulgação pública de riscos da OpenAI. Com sua saída, a empresa não informou quem escreverá o próximo system card nem se a abordagem vai mudar. Se os três pesquisadores demitidos vão se manifestar publicamente também é algo que depende dos próximos dias.

Fontes: reportagem do Wall Street Journal que confirmou os nomes dos três e os motivos da demissão, CocoLoop, ensaio assinado por David Robinson na The Atlantic, Business Insider, Agence France-Presse; o comunicado público da OpenAI foi verificado em relação à citação original.