GPT-6.1 Sol 출시, 가격 Astra 5분의 1

OpenAI는 9월 29일 데브데이에서 GPT-6.1 Sol을 공개했다. 코딩 에이전트, 컴퓨터 조작, 전문 사무 업무를 겨냥한 모델이다. API 표준 가격은 입력 100만 토큰당 2달러, 캐시 입력 0.10달러, 출력 10달러로 GPT-6 Sol과 동일하다. 플래그십 모델인 GPT-6 Astra의 10달러, 0.20달러, 50달러와 비교하면 입력과 출력 모두 5분의 1 수준이다.

출시 속도는 빠르다. GPT-6 Astra가 나온 지 26일, GPT-6 Sol이 나온 지는 겨우 7일 만에 6.1 버전으로 교체됐다. OpenAI에 따르면 신모델은 코딩과 컴퓨터 조작 성능에서 "Astra에 근접했다".

플래그십에 근접한 성적, 일부는 여전히 격차

OpenAI가 공개한 성적에 따르면 GPT-6.1 Sol은 DeepSWE v1.1에서 높은 추론 단계 기준 75.2%를 기록해 Astra와 동률을 이뤘고, 비용은 약 5분의 1이었다. OSWorld 2.0에서는 최고 추론 단계에서 71.4%를 기록해 Astra보다 2.1%포인트 낮았지만, 작업당 비용은 약 7분의 1이었다. 명령줄 기반 연구 워크플로를 평가하는 Terminal-Bench Science 0.1에서는 작업당 평균 5.47달러가 들었는데, Claude Opus 5.5는 23.21달러, Astra는 23.80달러였다.

서드파티 Artificial Analysis의 독립 테스트도 비슷한 결론을 냈다. 지능 지수는 GPT-6 Sol보다 4점 높고 GPT-6 Astra보다 1점 낮았다. 지식 정확도 테스트에서는 환각률이 60%에서 54%로 낮아졌다. 대신 말이 많아져서 같은 작업을 완료하는 데 출력 토큰이 10~30% 더 필요했다. 캐시 읽기 할인율이 90%에서 95%로 오르면서 이 비용 증가분의 일부를 상쇄했다.

모든 항목이 이렇게 근접한 것은 아니다. OpenAI가 공개한 자체 데이터에 따르면 내부 벤치마크인 ExploitBench에서 Sol은 21.5%, Astra는 31.5%였다. 장애 대응 능력을 보는 TroubleshootingBench에서는 47.96% 대 63.46%로 나타났다. 긴 연쇄적 디버깅이 필요한 상황에서는 플래그십이 여전히 뚜렷한 우위를 보인다.

이용 조건과 몇 가지 제한

GPT-6.1 Sol은 현재 ChatGPT Work와 Codex에서 Plus, Pro, Business, Enterprise, Edu 사용자에게 제공된다. 무료 버전과 Go 사용자는 아직 이용할 수 없고, 일반 채팅 화면에도 아직 적용되지 않았다. 개발자는 gpt-6.1-sol로 호출할 수 있으며, 컨텍스트 윈도는 약 105만 토큰, 1회 최대 출력은 12만 8000토큰이다.

몇 가지 유의할 점이 있다.

  • 프롬프트 하나가 27만 2000토큰을 넘으면 초과분은 입력 2배, 출력 1.5배로 과금된다
  • none과 minimal 추론 강도 단계는 지원하지 않는다
  • Chat Completions 엔드포인트에서는 도구 호출이 불가능해 Responses API로 전환해야 한다

두 번째 항목은 실시간 상호작용을 다루는 팀에 가장 큰 영향을 준다. 추론을 꺼서 지연 시간을 줄이던 기존 방식이 6.1 Sol에서는 통하지 않는다.

중국 개발자는 어디서 쓸 수 있나

OpenAI 공식 API는 2024년 7월부터 중국 본토에는 제공되지 않고 있으며, 이 점은 달라지지 않았다. 이번 출시 명단에 포함된 서드파티 채널들이 중국 개발자의 실제 상황에 더 가깝다. OpenRouter와 Vercel AI Gateway가 동시에 지원을 시작했고, GitHub Copilot의 Pro+, Max, Business, Enterprise 등급에서도 이용할 수 있게 됐다.

중국 팀 입장에서 더 직접적인 비교 대상은 자국산 모델의 가격대다. GLM-5.3이 공개한 API 가격은 출력 100만 토큰당 4.4달러로 GPT-6.1 Sol의 절반에도 못 미친다. Sol이 플래그십급 코딩 성능을 10달러대로 낮추면서, 코딩 분야에서 자국산 모델이 벌려놓았던 가격 격차가 다소 좁혀진 셈이다. 각사가 뒤따라 가격을 내릴지는 더 지켜봐야 한다.

또 다른 변수는 OpenAI 자신에게 있다. OpenAI는 하루 전 10월 출시 예정이던 GPT-6.1 Astra를 철회했는데, 안전성 기준을 충족하지 못했다는 이유였다. 플래그십 라인의 다음 업데이트 시점은 아직 정해지지 않았다. 그 전까지는 6.1 Sol이 OpenAI가 개발자에게 가장 적극적으로 미는 모델이 될 가능성이 크다.

참고 출처: OpenAI 공식 발표 페이지와 데브데이 리뷰, Artificial Analysis 독립 벤치마크, CocoLoop, DataCamp와 Vellum의 벤치마크 정리; API 등급별 단가, 컨텍스트 길이, 긴 프롬프트 과금 배율은 OpenAI가 공개한 수치를 따른다.