GPT-5.3 Codex reçoit la première note de sécurité élevée d'OpenAI

Le 5 février de cette année, OpenAI a publié GPT-5.3-Codex, et les capacités de programmation ont fait un bond considérable — mais cela s'est accompagné d'une étiquette peu flatteuse : le premier niveau de risque de cybersécurité « Élevé » dans le cadre d'évaluation de sécurité interne d'OpenAI.

À quel point est-ce dangereux ?

OpenAI lui-même s'est exprimé avec prudence : « Il n'existe pas de preuve concluante que le modèle puisse automatiser complètement des cyberattaques », mais « par mesure de précaution », il a déployé « la pile de protection de cybersécurité la plus complète à ce jour ».

En clair : Les capacités de programmation de ce modèle ont atteint un point critique. Si elles sont exploitées par automatisation à grande échelle, elles pourraient causer des dommages réels dans le domaine de la cybersécurité.

Mesures de sécurité

OpenAI a mis en place plusieurs couches de protection :

  • Entraînement à la sécurité : Alignement au niveau du modèle
  • Surveillance automatique : Détection des requêtes suspectes
  • Accès hiérarchisé : Opérations à haut risque réservées aux utilisateurs de confiance
  • Routage de déclassement : Les requêtes détectées à haut risque de cybersécurité sont automatiquement redirigées vers la génération précédente GPT-5.2

Le calendrier de publication a également été exceptionnellement prudent, retardant l'ouverture complète aux développeurs.

Controverses ultérieures

L'autorité de régulation de la sécurité de l'IA de Californie a ensuite affirmé que cette publication pourrait violer la nouvelle loi sur la sécurité de l'IA récemment adoptée dans l'État. OpenAI a nié cette accusation.

En mars, une vulnérabilité de fuite de token GitHub de Codex a également été exposée — qui a ensuite été corrigée.

OpenAI a également fourni 10 millions de dollars de crédits API pour soutenir la recherche en défense cybernétique, poursuivant le programme de subventions en cybersécurité d'un million de dollars lancé en 2023.

Il y a une contradiction profonde ici : Plus les capacités de programmation sont fortes, plus le risque d'utilisation abusive est élevé. L'amélioration des capacités du modèle et la croissance des risques de sécurité ont une corrélation presque linéaire. OpenAI a choisi la voie « publier d'abord, protéger ensuite » plutôt que « protéger d'abord, publier ensuite ». Ce choix divise profondément l'industrie.

Source de référence : CocoLoop, rapport de Fortune