GPT-5.4, Codex 추론과 Computer Use를 하나로 통합

3월 5일 OpenAI가 GPT-5.4를 출시했습니다. 가장 큰 변화는 더 이상 전용 프로그래밍 모델이 없다는 점입니다.

이전에는 GPT-5.3-Codex가 메인 GPT-5.x 라인과 별도로 출시된 독립적인 프로그래밍 전용 모델이었습니다. 이제 GPT-5.4는 최첨단 프로그래밍 능력, 추론 능력, Computer Use를 단일 모델 아키텍처로 직접 통합했습니다.

세 가지 능력

분야 GPT-5.4 GPT-5.3-Codex 대비
프로그래밍 (SWE-bench Pro) 57.7% 55.6%
컴퓨터 조작 (OSWorld) 75% 64%
지식 작업 (GDPval) 83% 없음

프로그래밍은 약간 향상되었고, 컴퓨터 조작은 큰 폭으로 앞서며, 지식 작업 능력은 Codex에는 전혀 없었던 것입니다. 세 가지 분야 모두에서 최첨단 수준에 도달한 최초의 단일 모델입니다.

다섯 가지 버전

  • Standard: 일반 버전
  • Thinking: 심층 추론 버전
  • Pro: 고성능 버전
  • Mini: 경량 버전
  • Nano: 초경량 버전

API 가격은 몇 달러에서 수십 달러까지 전 범위를 포괄합니다. ChatGPT에서는 "GPT-5.4 Thinking", API에서는 gpt-5.4로 불립니다.

100만 토큰 컨텍스트를 실험적으로 지원하며, model_context_windowmodel_auto_compact_token_limit 매개변수로 구성할 수 있습니다.

전략적 신호

GPT-5.4는 OpenAI의 제품 전략에서 명확한 전환을 나타냅니다. "시나리오별로 다른 모델"에서 "하나의 모델로 모든 것을 처리"하는 방향으로의 전환입니다.

이는 DeepSeek V3.1의 하이브리드 모델 접근 방식 및 Qwen3의 듀얼 모드 설계와 궤를 같이합니다. "통합 모델"이 업계의 합의가 되어가고 있는 것으로 보입니다. 사용자는 "이 문제에 어떤 모델을 사용해야 할지" 고민할 필요가 없어집니다.

참고 출처: CocoLoop, NxCode 기술 가이드