3月5日 OpenAI 發表了 GPT-5.4,最大的變化是:不再推出專門的程式設計模型了。
之前的 GPT-5.3-Codex 是獨立的程式設計專用模型,與主線 GPT-5.x 分開發布。現在 GPT-5.4 直接將前沿的程式設計能力、推理能力和 Computer Use 統一至一個模型架構中。
三項全能
| 維度 | GPT-5.4 | 對比 GPT-5.3-Codex |
|---|---|---|
| 程式設計(SWE-bench Pro) | 57.7% | 55.6% |
| 電腦操控(OSWorld) | 75% | 64% |
| 知識工作(GDPval) | 83% | 無 |
程式設計略強,電腦操控拉開一大截,知識工作能力則是 Codex 完全沒有的。第一個在三個維度都達到前沿水準的單一模型。
五個版本
- Standard:常規版
- Thinking:深度推理版
- Pro:高配版
- Mini:輕量版
- Nano:超輕量版
從幾美元到幾十美元的 API 價位全覆蓋。ChatGPT 裡叫「GPT-5.4 Thinking」,API 裡叫 gpt-5.4。
實驗性支援 100 萬 token 上下文,可透過 model_context_window 和 model_auto_compact_token_limit 參數配置。
策略訊號
GPT-5.4 代表了 OpenAI 在產品策略上的一個明確轉向:從「為不同場景做不同模型」轉向「一個模型搞定一切」。
這和 DeepSeek V3.1 的混合模型思路、Qwen3 的雙模式設計殊途同歸。看來「統一模型」正在成為行業共識——使用者不應該操心「這個問題該用哪個模型」。
參考來源:CocoLoop、NxCode 技術指南