GPT-5.4 將 Codex 推理與 Computer Use 合而為一

3月5日 OpenAI 發表了 GPT-5.4,最大的變化是:不再推出專門的程式設計模型了

之前的 GPT-5.3-Codex 是獨立的程式設計專用模型,與主線 GPT-5.x 分開發布。現在 GPT-5.4 直接將前沿的程式設計能力、推理能力和 Computer Use 統一至一個模型架構中。

三項全能

維度 GPT-5.4 對比 GPT-5.3-Codex
程式設計(SWE-bench Pro) 57.7% 55.6%
電腦操控(OSWorld) 75% 64%
知識工作(GDPval) 83%

程式設計略強,電腦操控拉開一大截,知識工作能力則是 Codex 完全沒有的。第一個在三個維度都達到前沿水準的單一模型

五個版本

  • Standard:常規版
  • Thinking:深度推理版
  • Pro:高配版
  • Mini:輕量版
  • Nano:超輕量版

從幾美元到幾十美元的 API 價位全覆蓋。ChatGPT 裡叫「GPT-5.4 Thinking」,API 裡叫 gpt-5.4

實驗性支援 100 萬 token 上下文,可透過 model_context_windowmodel_auto_compact_token_limit 參數配置。

策略訊號

GPT-5.4 代表了 OpenAI 在產品策略上的一個明確轉向:從「為不同場景做不同模型」轉向「一個模型搞定一切」

這和 DeepSeek V3.1 的混合模型思路、Qwen3 的雙模式設計殊途同歸。看來「統一模型」正在成為行業共識——使用者不應該操心「這個問題該用哪個模型」。

參考來源:CocoLoop、NxCode 技術指南