OpenAI, Moonshot AI 증류 의혹 제기

OpenAI는 9월 30일 발표에서, 자사 추론 모델이 보호하고 있는 추론 내용을 빼내려 한 조직적인 모델 증류(distillation) 행위를 포착해 무력화했다고 밝혔다. OpenAI는 이 가운데 하나의 '핵심 클러스터'의 활동을 Moonshot AI를 위해 일하는 인물들과 연결지었다. Moonshot AI는 CyberScoop의 논평 요청에 응하지 않았다.

7월 1일부터 7월 28일까지

OpenAI가 공개한 타임라인에 따르면.

  • 7월 1일, 낮은 수준의 의심스러운 활동이 처음 포착됐고 이후 점차 늘어났다.
  • 7월 24일에서 25일 사이, 약 4000명의 사용자가 동일한 추출 패턴에 해당하는 약 1만 6000건의 프롬프트를 보냈다.
  • 7월 28일, 의심 사용자 수가 약 1만 5000명으로 늘었고 OpenAI는 이날 해당 행위를 '완전히 무력화했다'고 밝혔다.

수법과 관련해 OpenAI는 상대가 암호를 해독하거나 데이터베이스에 침입하지 않았고, 저장된 사용자 대화 내용도 확보하지 못했다고 설명했다. 대신 이들은 모델과의 상호작용을 조작해, 원래는 숨겨져야 할 추론 내용을 요청자가 볼 수 있는 형태로 다시 말하게 만들었다. CyberScoop은 이 중 한 기법을 '새로운 형태의 암호 우회'라고 표현했다. 한 세션에서 암호화된 추론 데이터를 복사한 뒤, 다른 세션으로 옮겨 모델이 이를 복호화해 평문으로 옮기도록 하는 방식이다.

"그들은 모델과의 상호작용을 조작해 보호된 추론 내용이 요청자가 볼 수 있는 형태로 재현되도록 했다."

OpenAI의 대응에는 계정 차단, 가입·인프라 통제 강화, 네트워크 모니터링 확대, 그리고 세션 간 복호화를 가능하게 했던 결함 수정이 포함됐다. 관련 발견 내용은 프론티어 모델 포럼(Frontier Model Forum)과 정부 채널을 통해 공유됐다. OpenAI는 추론 내용이 유출되면 원본 모델의 안전장치가 없는 파생 모델을 학습시키는 데 쓰일 수 있어, 안전과 국가안보 양쪽에 위험을 초래한다고 밝혔다.

근거는 단 한 문장뿐

CyberScoop은 OpenAI의 블로그 게시물이 이번 활동을 Moonshot AI와 연결짓는 기술적 증거나 추론 과정을 제시하지 않았다고 지적했다. 표현은 'Moonshot AI를 위해 일하는 인물들'로, 이것이 개인 차원의 행위인지 회사 차원의 지시인지는 본문에서 구분하지 않는다. 현재 공개된 자료만으로는 외부에서 이 연결을 독립적으로 검증할 수 없다.

지난 몇 달간 미국 측은 중국 기업들이 미국 모델을 증류하고 있다고 여러 차례 공개적으로 지적해왔고, 백악관 과학고문도 비슷한 발언을 한 바 있다. 이번이 다른 점은 OpenAI가 구체적인 날짜, 사용자 수, 공격 수법을 제시하고 수백억 달러 가치의 중국 기업을 본문에 직접 거명했다는 것이다.

같은 주에 전해진 또 다른 소식

이 의혹이 제기된 것과 같은 시기, Kimi K3는 막 OpenAI의 기업 영업 체계에 진입한 참이었다. 미국 추론 서비스 업체 Baseten이 Kimi K3를 호스팅하며, 기업 고객은 Codex 안에서 직접 이를 호출할 수 있다. 이때 발생하는 비용은 이미 체결한 OpenAI와의 구매 약정에 포함되며, 별도의 공급업체 계약은 필요 없다. 이는 중국산 오픈소스 모델이 처음으로 OpenAI의 기업용 과금 체계에 들어간 사례로 받아들여진다. Baseten의 필립 킬리(Philip Kiely)는 이제 기업 팀이 Codex 안에서 GLM-5.3 Flash나 Kimi K3 같은 오픈소스 모델을 네이티브로 쓸 수 있다고 적었다. Codex 책임자 티보(Tibo)는 이를 재공유하며 'Open is the way.'라는 한마디만 남겼다.

중국 모델 기업들과 이를 주시하는 개발자들에게는 이 두 소식을 함께 놓고 보면 더 많은 정보가 읽힌다. 오픈 웨이트 덕분에 Kimi K3는 미국 기업의 호스팅을 거쳐 미국 기업에 판매되면서 수출·조달 장벽을 우회할 수 있다. 그런데 같은 회사가 OpenAI로부터 증류 행위의 연관자로 지목받기도 했다. 해외 고객이 구매 시 추가적인 컴플라이언스 심사를 받게 될지는 앞으로 더 많은 증거가 공개되는지에 달려 있다.

OpenAI는 이번 의혹이 Codex 내 Kimi K3 제공에 영향을 미치는지는 밝히지 않았으며, Baseten과 Moonshot AI 모두 이에 대해 입장을 내지 않았다.

참고 출처: OpenAI 공식 블로그, CyberScoop, TechNode, CocoLoop. 의심 사용자 수와 프롬프트 건수는 OpenAI의 공개 수치를, Codex 기업 채널의 과금 방식은 Baseten 측 발표를 기준으로 했다.