GPT-5.3 Codex recebe primeira classificação de segurança alta da OpenAI

Em 5 de fevereiro deste ano, a OpenAI lançou o GPT-5.3-Codex, e as capacidades de programação realmente deram um salto significativo — mas junto veio um rótulo nada agradável: o primeiro nível de risco de segurança cibernética "Alto" no framework interno de avaliação de segurança da OpenAI.

Quão perigoso é?

A própria OpenAI foi cautelosa: "Não há evidências conclusivas de que o modelo possa automatizar completamente ataques cibernéticos", mas "por precaução" implementou "o stack de proteção de segurança cibernética mais abrangente até hoje".

Traduzindo: As habilidades de programação deste modelo atingiram um ponto crítico. Se explorado em automação em larga escala, pode causar danos reais no campo da segurança cibernética.

Medidas de segurança

A OpenAI adotou várias camadas de proteção:

  • Treinamento de segurança: Alinhamento no nível do modelo
  • Monitoramento automático: Detecção de solicitações suspeitas
  • Acesso hierárquico: Operações de alto risco apenas para usuários confiáveis
  • Roteamento de rebaixamento: Solicitações detectadas com alto risco de segurança cibernética são automaticamente encaminhadas para a geração anterior GPT-5.2

O cronograma de lançamento também foi excepcionalmente cauteloso, adiando a liberação completa para desenvolvedores.

Controvérsias subsequentes

O órgão regulador de segurança de IA da Califórnia posteriormente afirmou que este lançamento pode ter violado a nova lei de segurança de IA recém-aprovada no estado. A OpenAI negou a acusação.

Em março, também foi exposta uma vulnerabilidade de vazamento de token do GitHub do Codex — que posteriormente foi corrigida.

A OpenAI também disponibilizou US$ 10 milhões em créditos de API para apoiar pesquisas de defesa cibernética, dando continuidade ao programa de subsídios de segurança cibernética de US$ 1 milhão iniciado em 2023.

Há uma contradição profunda aqui: Quanto mais forte a capacidade de programação, maior o risco de uso indevido. A melhoria das capacidades do modelo e o aumento dos riscos de segurança têm uma correlação quase linear. A OpenAI escolheu o caminho de "lançar primeiro, proteger depois" em vez de "proteger primeiro, lançar depois". Sobre essa escolha, há grande divergência na indústria.

Fonte de referência: CocoLoop, reportagem da Fortune