OpenAI가 구독형 제품에서 GPT-6 Astra와 GPT-6.1 Sol의 기본 출력 속도를 한 단계 끌어올렸다. Codex 담당 책임자 티보 소티오(Thibault Sottiaux)는 10월 5일 소셜 미디어를 통해 두 모델의 기본 속도가 전반적으로 약 50% 향상됐으며, 출력 속도가 초당 약 30토큰에서 약 50토큰으로 늘었다고 밝혔다. 이번 변경은 OpenAI 자체 제품 전부와 "Sign in with ChatGPT"로 연동되는 모든 파트너 앱에 적용된다.
사용자가 별도로 설정을 바꿀 필요는 없다. 소티오는 업데이트가 두 시간 안에 모든 사용자에게 순차적으로 적용될 것이라고 말했다.
다음 날 내놓은 "개선"
이번 속도 향상의 시점은 우연이 아니다. 10월 4일 소티오는 Codex 팀에 28일간의 공개 기한을 제시했다. 매일 Codex와 ChatGPT Work 사용자 대다수가 분명히 느낄 수 있는 개선 사항을 하나씩 내놓거나, 그러지 못하면 전체 사용자의 사용량을 완전히 초기화하겠다는 내용이다.
속도 향상은 "대다수 사용자가 체감할 수 있다"는 기준에 정확히 부합한다. 코딩, 자료 조사, 에이전트 작업 등 특정 용도를 가리지 않고 모두 혜택을 받고, 사용자가 새 기능을 따로 배울 필요도 없다. 매일 뭔가를 내놓아야 하는 약속 속에서 이런 변화가 가장 쉽게 인정받는다.
적용 범위도 ChatGPT 한 곳에 그치지 않는다. 소티오가 언급한 파트너에는 오픈소스 코딩 도구 OpenCode와 Pi, Amp, 그리고 Cognition의 Devin이 포함된다. 이 제품들은 사용자가 ChatGPT 구독 계정으로 바로 로그인할 수 있게 해주며, 소비되는 것은 구독 쪽 할당량이지 API 과금이 아니다. 그래서 구독 쪽 속도 향상이 그대로 전달된다.
30에서 50, 계산하면 절반 이상
공식 발표 제목은 "약 50%"라고 했지만, 그가 제시한 두 숫자, 즉 초당 30토큰에서 50토큰으로 계산하면 증가율은 약 67%에 이른다. 이 두 수치의 차이에 대해 소티오는 설명하지 않았다. 가능한 해석 중 하나는 50%가 첫 토큰이 나오기까지 걸리는 대기 시간 등을 포함한 전체 경험을 가리키고, 생성 단계만 놓고 보면 3분의 2가 빨라졌다는 것이다.
사용자가 실제로 체감할 시간으로 바꿔 대략 계산하면 다음과 같다.
| 출력 길이 | 초당 30토큰 | 초당 50토큰 |
|---|---|---|
| 2000토큰 분량의 코드 | 약 67초 | 약 40초 |
| 2만 토큰짜리 에이전트 작업 출력 | 약 11분 | 약 6.7분 |
이는 모델이 글자를 생성하는 시간만 계산한 것이다. 에이전트 작업에는 도구 호출, 테스트 실행, 네트워크 대기 시간도 포함되는데, 이 부분은 속도 향상으로 줄어들지 않는다. 따라서 실제로 작업을 끝내는 데 걸리는 시간이 줄어드는 비율은 표에 나온 수치보다 낮을 것이다.
토크나이저와 토큰 소비량
소티오는 두 모델이 최적화된 토크나이저를 적용해 같은 작업을 완료하는 데 필요한 토큰 수도 줄었다고 언급했다. 구체적으로 얼마나 줄었는지는 OpenAI가 수치를 밝히지 않았다.
이 부분은 구독 사용자에게 속도 향상보다 더 직접적인 영향을 줄 수 있다. Codex와 ChatGPT Work의 사용량 한도는 토큰 소비량을 기준으로 계산되기 때문에, 같은 작업에 쓰이는 토큰이 줄면 같은 한도로 더 많은 작업을 할 수 있다. 반대로 속도 향상 자체는 한도를 바꾸지 않는다. 출력이 빨라진 만큼 사용자는 5시간짜리 사용 구간의 한도에 더 빨리 도달할 뿐이다. 일부 매체는 보도에서 이 점을 특별히 짚었다.
GPT-6.1 Sol은 9월 29일 DevDay에서 공개될 당시, 제3자 테스트에서 같은 작업을 완료하는 데 이전 세대보다 출력 토큰을 10%에서 30% 더 많이 쓰는 것으로 나타났다. 새 토크나이저가 이 차이를 얼마나 상쇄할 수 있는지는 독립적인 재테스트가 이뤄져야 알 수 있다.
API 쪽은 아직 변화 없음
두 모델의 역할 구분은 분명하다. GPT-6 Astra는 플래그십 모델로, API 표준 가격은 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러다. GPT-6.1 Sol은 코딩 에이전트와 컴퓨터 조작 작업을 겨냥한 모델로 입력 2달러, 출력 10달러이며, 둘 다 Astra의 5분의 1 가격이다. 이번 구독 쪽 속도 향상은 두 모델 모두에 동시에 적용된다.
이번 조정은 구독형 제품의 기본 속도에만 관련된다. API 사용자는 토큰 단위로 요금을 내는데, API 쪽 속도도 함께 바뀌는지에 대해서는 소티오의 발언에 언급이 없었고, OpenAI의 API 문서에도 관련 업데이트가 아직 없다.
참고 출처: 티보 소티오의 소셜 미디어 공개 발언, CocoLoop, RuntimeWire, Crypto Briefing. 출력 속도는 공식적으로 제시된 초당 토큰 수치를 기준으로 하며, 증가율과 소요 시간은 이 기준으로 추산한 것이다.