AI 빅3 연합, DeepSeek 등 중국 기업이 1600만 회 대화 증류했다고 비난

4월 초 AI 업계에서 가장 폭발적인 소식은 새로운 모델 출시가 아니라, 평소에는 서로 경쟁하는 OpenAI, Anthropic, Google이 중국 AI 기업에 공동 대응하기 위해 갑자기 연합을 발표한 것입니다.

구체적으로, 세 회사는 Frontier Model Forum(2023년 이들 회사와 Microsoft가 공동 설립한 포럼)을 통해 정보를 공유하기 시작했으며, 목표는 '증류 공격', 즉 경쟁사가 대규모 모델의 출력을 사용하여 자체 소형 모델을 훈련하는 행위를 근절하는 것입니다.

지목된 중국 기업은 세 곳입니다: DeepSeek, Moonshot AI(Kimi의 모회사), MiniMax.

'증류 공격'이란 무엇인가?

방법은 복잡하지 않습니다. 대상 모델에 정교하게 설계된 수많은 프롬프트를 입력하고, 반환된 결과를 수집하여 자체 모델 훈련에 사용하는 것입니다.

상대방의 모델 아키텍처를 알 필요도, 가중치를 얻을 필요도 없습니다. 자체 모델이 상대방의 추론 방식과 지식 구조를 상당 부분 학습할 수 있습니다. OpenAI는 DeepSeek R1이 출시되었을 때부터 이를 의심했으며, Sam Altman은 당시 DeepSeek이 "GPT 모델을 부적절하게 증류했다"고 공개적으로 밝혔습니다.

이제 Anthropic이 구체적인 수치를 제시했습니다. 이 세 중국 기업은 약 24,000개의 가짜 계정을 통해 Claude와 1,600만 회 이상 상호작용했습니다.

이는 정상적인 사용자 행동이 아닙니다. 1,600만 회의 상호작용은 산업 규모의 체계적인 데이터 마이닝이며, 플랫폼 이용약관 탐지를 회피하기 위해 대량의 위조 계정을 통해 수행되었습니다.

세 경쟁사가 왜 갑자기 동맹을 맺었는가?

이 세 회사를 경쟁사라고 부르는 것은 과소평가입니다. OpenAI와 Anthropic은 동일한 기업 계약을 두고 경쟁하고, Google은 두 회사 모두와 직접 경쟁합니다. 그러나 문제의 규모가 단일 회사의 방어 조치만으로는 감당할 수 없을 정도로 커지면 경쟁은 일시적으로 뒷전으로 밀려납니다.

Frontier Model Forum의 정보 공유 메커니즘은 한 회사가 새로운 증류 공격 패턴을 발견하면 다른 두 회사가 방어 전략을 동기화하여 업데이트할 수 있음을 의미합니다.

Anthropic은 이 협력에 무엇을 기여했을까요? 'Project Glasswing'을 출시하여 고성능 Claude Mythos 모델에 대한 액세스를 특정 파트너로 제한하고, 더 엄격한 보안 탐지 메커니즘을 도입했으며, AWS, Google, Microsoft 등 방어 보안 파트너에게 1억 달러 상당의 사용 크레딧을 제공하기로 약속했습니다.

중국 기업이 정확히 무엇을 훔쳤는가?

Anthropic의 주장에 따르면, 증류는 컴퓨터 비전, 코드 생성, 복잡한 추론 등 여러 핵심 능력 영역을 포함합니다.

이들 기업의 제품 로드맵을 비교하면 맥락을 이해할 수 있습니다.

기업 주요 제품 비난받은 능력과의 연관성
DeepSeek R 시리즈 추론 모델 복잡한 추론 능력
Moonshot AI Kimi 장문맥 모델 문서 이해, 코드 능력
MiniMax 비디오 생성, 멀티모달 시각 이해

각 기업의 증류 대상은 다를 수 있지만, 공통점은 수억 달러의 훈련 비용을 들이지 않고도 최첨단에 가까운 능력을 얻을 수 있다는 점입니다.

이것이 오픈소스 AI에 의미하는 바는?

더 넓게 보면, 이 연합의 결성은 AI 업계가 '지식재산권 보호 단계'에 접어들었음을 어느 정도 시사합니다.

이전에는 AI의 개방성, 오픈소스, 모델 공유에 초점이 맞춰져 있었습니다. 이제 Anthropic은 자사의 가장 강력한 모델에 대한 액세스를 직접 제한하고 있으며, OpenAI도 이용약관 집행을 강화하고 있습니다.

증류 방지가 업계 표준이 된다면, API 호출에 의존하여 자체 모델을 최적화하는 연구자와 소규모 기업도 영향을 받을 것입니다. '정상적인 API 호출'과 '체계적인 증류 수집'을 구분하는 것은 기술적으로나 정책적으로 해결하기 어려운 문제이기 때문입니다.

현재, 지목된 세 중국 기업 모두 이러한 비난에 대해 공개적으로 대응하지 않고 있습니다.

출처: CocoLoop, OpenAI, Anthropic, Google Unite to Combat Model Copying in China (Bloomberg); OpenAI, Google, Anthropic Unite Against AI Model Theft (Built In); OpenAI, Anthropic and Google Unite Against China AI Distillation (resultsense.com)