Astra·Sol 출력속도 초당 50토큰으로 향상

OpenAI가 구독형 제품에서 GPT-6 Astra와 GPT-6.1 Sol의 기본 출력 속도를 한 단계 끌어올렸다. Codex 담당 책임자 티보 소티오(Thibault Sottiaux)는 10월 5일 소셜 미디어를 통해 두 모델의 기본 속도가 전반적으로 약 50% 향상됐으며, 출력 속도가 초당 약 30토큰에서 약 50토큰으로 늘었다고 밝혔다. 이번 변경은 OpenAI 자체 제품 전부와 "Sign in with ChatGPT"로 연동되는 모든 파트너 앱에 적용된다.

사용자가 별도로 설정을 바꿀 필요는 없다. 소티오는 업데이트가 두 시간 안에 모든 사용자에게 순차적으로 적용될 것이라고 말했다.

다음 날 내놓은 "개선"

이번 속도 향상의 시점은 우연이 아니다. 10월 4일 소티오는 Codex 팀에 28일간의 공개 기한을 제시했다. 매일 Codex와 ChatGPT Work 사용자 대다수가 분명히 느낄 수 있는 개선 사항을 하나씩 내놓거나, 그러지 못하면 전체 사용자의 사용량을 완전히 초기화하겠다는 내용이다.

속도 향상은 "대다수 사용자가 체감할 수 있다"는 기준에 정확히 부합한다. 코딩, 자료 조사, 에이전트 작업 등 특정 용도를 가리지 않고 모두 혜택을 받고, 사용자가 새 기능을 따로 배울 필요도 없다. 매일 뭔가를 내놓아야 하는 약속 속에서 이런 변화가 가장 쉽게 인정받는다.

적용 범위도 ChatGPT 한 곳에 그치지 않는다. 소티오가 언급한 파트너에는 오픈소스 코딩 도구 OpenCode와 Pi, Amp, 그리고 Cognition의 Devin이 포함된다. 이 제품들은 사용자가 ChatGPT 구독 계정으로 바로 로그인할 수 있게 해주며, 소비되는 것은 구독 쪽 할당량이지 API 과금이 아니다. 그래서 구독 쪽 속도 향상이 그대로 전달된다.

30에서 50, 계산하면 절반 이상

공식 발표 제목은 "약 50%"라고 했지만, 그가 제시한 두 숫자, 즉 초당 30토큰에서 50토큰으로 계산하면 증가율은 약 67%에 이른다. 이 두 수치의 차이에 대해 소티오는 설명하지 않았다. 가능한 해석 중 하나는 50%가 첫 토큰이 나오기까지 걸리는 대기 시간 등을 포함한 전체 경험을 가리키고, 생성 단계만 놓고 보면 3분의 2가 빨라졌다는 것이다.

사용자가 실제로 체감할 시간으로 바꿔 대략 계산하면 다음과 같다.

출력 길이초당 30토큰초당 50토큰
2000토큰 분량의 코드약 67초약 40초
2만 토큰짜리 에이전트 작업 출력약 11분약 6.7분

이는 모델이 글자를 생성하는 시간만 계산한 것이다. 에이전트 작업에는 도구 호출, 테스트 실행, 네트워크 대기 시간도 포함되는데, 이 부분은 속도 향상으로 줄어들지 않는다. 따라서 실제로 작업을 끝내는 데 걸리는 시간이 줄어드는 비율은 표에 나온 수치보다 낮을 것이다.

토크나이저와 토큰 소비량

소티오는 두 모델이 최적화된 토크나이저를 적용해 같은 작업을 완료하는 데 필요한 토큰 수도 줄었다고 언급했다. 구체적으로 얼마나 줄었는지는 OpenAI가 수치를 밝히지 않았다.

이 부분은 구독 사용자에게 속도 향상보다 더 직접적인 영향을 줄 수 있다. Codex와 ChatGPT Work의 사용량 한도는 토큰 소비량을 기준으로 계산되기 때문에, 같은 작업에 쓰이는 토큰이 줄면 같은 한도로 더 많은 작업을 할 수 있다. 반대로 속도 향상 자체는 한도를 바꾸지 않는다. 출력이 빨라진 만큼 사용자는 5시간짜리 사용 구간의 한도에 더 빨리 도달할 뿐이다. 일부 매체는 보도에서 이 점을 특별히 짚었다.

GPT-6.1 Sol은 9월 29일 DevDay에서 공개될 당시, 제3자 테스트에서 같은 작업을 완료하는 데 이전 세대보다 출력 토큰을 10%에서 30% 더 많이 쓰는 것으로 나타났다. 새 토크나이저가 이 차이를 얼마나 상쇄할 수 있는지는 독립적인 재테스트가 이뤄져야 알 수 있다.

API 쪽은 아직 변화 없음

두 모델의 역할 구분은 분명하다. GPT-6 Astra는 플래그십 모델로, API 표준 가격은 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러다. GPT-6.1 Sol은 코딩 에이전트와 컴퓨터 조작 작업을 겨냥한 모델로 입력 2달러, 출력 10달러이며, 둘 다 Astra의 5분의 1 가격이다. 이번 구독 쪽 속도 향상은 두 모델 모두에 동시에 적용된다.

이번 조정은 구독형 제품의 기본 속도에만 관련된다. API 사용자는 토큰 단위로 요금을 내는데, API 쪽 속도도 함께 바뀌는지에 대해서는 소티오의 발언에 언급이 없었고, OpenAI의 API 문서에도 관련 업데이트가 아직 없다.

참고 출처: 티보 소티오의 소셜 미디어 공개 발언, CocoLoop, RuntimeWire, Crypto Briefing. 출력 속도는 공식적으로 제시된 초당 토큰 수치를 기준으로 하며, 증가율과 소요 시간은 이 기준으로 추산한 것이다.