Le 5 mars, OpenAI a publié GPT-5.4. Le changement le plus important est : il n'y a plus de modèle de programmation dédié.
Auparavant, GPT-5.3-Codex était un modèle de programmation dédié indépendant, publié séparément de la ligne principale GPT-5.x. Désormais, GPT-5.4 fusionne directement les capacités de programmation de pointe, de raisonnement et de Computer Use en une seule architecture de modèle.
Triple compétence
| Dimension | GPT-5.4 | Comparé à GPT-5.3-Codex |
|---|---|---|
| Programmation (SWE-bench Pro) | 57,7 % | 55,6 % |
| Contrôle d'ordinateur (OSWorld) | 75 % | 64 % |
| Travail de connaissance (GDPval) | 83 % | Aucun |
La programmation est légèrement plus forte, le contrôle d'ordinateur est nettement supérieur, et la capacité de travail de connaissance était totalement absente chez Codex. Le premier modèle unique à atteindre un niveau de pointe dans les trois dimensions.
Cinq versions
- Standard : Version standard
- Thinking : Version de raisonnement profond
- Pro : Version haut de gamme
- Mini : Version légère
- Nano : Version ultra-légère
La gamme de prix de l'API couvre de quelques dollars à plusieurs dizaines de dollars. Dans ChatGPT, il s'appelle "GPT-5.4 Thinking" ; dans l'API, gpt-5.4.
Support expérimental pour 1 million de tokens de contexte, configurable via les paramètres model_context_window et model_auto_compact_token_limit.
Signal stratégique
GPT-5.4 représente un virage clair dans la stratégie produit d'OpenAI : passer de "créer des modèles différents pour des scénarios différents" à "un modèle qui fait tout".
Cela converge avec l'approche de modèle hybride de DeepSeek V3.1 et la conception à double mode de Qwen3. Il semble que le "modèle unifié" devienne un consensus dans l'industrie — l'utilisateur ne devrait pas avoir à se demander "quel modèle utiliser pour ce problème".
Source de référence : CocoLoop, Guide technique NxCode