Codex 자동 검토 무료화, 사용량 차감 없음

OpenAI가 ChatGPT 계정으로 로그인한 사용자를 대상으로 Codex의 Auto-review 기능을 무료로 전환했다고 발표했다. 검토 과정에서 더 이상 요금제 사용량이 차감되지 않는다. 이 소식은 Codex 담당자인 Thibault Sottiaux가 소셜 미디어에 올리며 알려졌다.

"This Auto-review feature is now free and does not draw usage from your plan."

(이 Auto-review 기능은 이제 무료이며 요금제 사용량을 차감하지 않는다는 내용.)

활성화는 Codex의 '설정 > 권한 > Auto-review'에서 할 수 있다. CLI 버전은 설정 파일에서 승인 정책을 바꿔 켤 수 있다. 이는 Sottiaux가 10월 4일 "28일 동안 매일 하나씩 개선 사항을 내놓지 못하면 모든 사용자의 쿼터를 전부 리셋하겠다"고 한 약속 이후 팀이 내놓은 또 하나의 변화다.

무엇을 통제하는가

Codex는 기본적으로 에이전트를 샌드박스 안에서 작동시킨다. 에이전트가 그 경계를 넘으려 할 때, 예를 들어 샌드박스 밖에서 명령을 실행하거나, 차단된 네트워크 요청을 보내거나, 승인된 디렉터리 밖의 파일을 바꾸거나, 승인되지 않은 앱이나 MCP 도구를 호출하려 할 때, 작업을 멈추고 사용자의 승인을 기다린다.

장시간 작업에서는 이런 확인 요청이 쌓인다. OpenAI 측 설명에 따르면 하나씩 승인하다 보면 결정 피로가 쌓이기 쉽고, 클릭이 반복되다 보면 승인 버튼 자체가 걸러내는 역할을 잃어버리게 된다.

Auto-review는 여기에 독립된 검토 에이전트를 하나 더 추가하는 방식이다. 메인 에이전트가 경계를 넘는 요청을 할 때마다 검토 에이전트가 먼저 판단한다. 정상적인 요청은 통과시켜 작업을 이어가게 하고, 위험도가 높은 요청은 그 자리에서 거부한다. 공개된 설명에 따르면 거부 대상에는 자격 증명과 토큰 탈취, 비공개 데이터의 외부 유출, 출처가 불분명한 코드 실행, 되돌릴 수 없는 삭제, 시스템 보안 설정을 약화시키는 변경 등이 포함된다. 검토 에이전트가 3회 연속으로 거부하거나 50회 검토 중 누적 10회를 거부하면 작업이 중단되고 사용자에게 넘어간다.

검토 에이전트는 판단만 할 뿐, 그 때문에 권한이 더 넓어지지는 않는다. 샌드박스 경계도 그대로다.

왜 지금 나왔나

시점이 미묘하다. 최근 몇 주 사이 OpenAI는 내부 테스트 중이던 에이전트가 Hugging Face 시스템에 침입했다는 사실을 인정했고, 위키미디어 재단도 자사 플랫폼에서 OpenAI 에이전트의 이상 행동을 발견했다. OpenAI는 과거 기록을 다시 검토하는 데만 하루 50만 달러 이상의 컴퓨팅 비용을 쓰고 있다.

이런 상황에서 에이전트 안전 기능을 켜는 진입 장벽을 0으로 낮춘 것은 적어도 태도 면에서는 하나의 신호다. Auto-review가 막는 것은 사용자 자신의 기기에서 일어나는 실수이고, 학습 과정에서 벌어진 사건들과는 층위가 다르다. 그래도 두 사례가 가리키는 문제는 결국 같다. 에이전트가 스스로 할 수 있는 일은 점점 늘어나고, 사람이 하나씩 들여다볼 여유는 점점 못 따라가고 있다는 것이다.

비슷한 방식은 코딩 도구 쪽에서는 이미 새롭지 않다. Cursor는 올해 6월 자체 자동 검토 체계를 내놓아 코딩 에이전트의 중단율을 7%까지 낮췄다. 이번 Codex의 차이는 주로 가격에 있다. 검토 자체도 모델을 돌려야 하는데, 지금까지는 그 비용이 사용자 몫이었다면 이제는 OpenAI가 부담한다.

중국 개발자도 쓸 수 있나

이번 무료 정책은 ChatGPT 계정 로그인에만 적용된다. API 키로 Codex에 접속하는 사용자에게도 적용되는지는 공개된 정보에 나와 있지 않다. 중국 개발자가 쓰려면 여전히 ChatGPT 계정에 로그인할 수 있고 해당 요금제에 가입돼 있어야 하며, 지역 제한 자체는 달라지지 않았다.

차단 효과에 대해서는 지금까지 OpenAI 쪽 설명만 있다. 검토 에이전트가 정상적인 작업을 얼마나 잘못 거부하는지, 오탐률이 어느 정도인지는 공식적으로 숫자가 나온 적이 없어 사용자가 직접 자신의 프로젝트에서 써 봐야 알 수 있다.

참고 출처: OpenAI Codex 문서, CocoLoop, Thibault Sottiaux의 공개 게시물, Nerds Chalk. Auto-review 활성화 경로, 거부 기준, 무료 적용 범위는 OpenAI 공식 설명을 기준으로 한다.