Claude Mythos, SWE-bench Pro 77.8%로 정상 등극

4월 7일, Anthropic이 다소 이례적인 발표를 했다. Claude Mythos라는 새 모델을 출시하면서, 동시에 이 모델을 대중에 공개하지 않겠다고 선언한 것이다.

"추후 공개"가 아니다. "현재는 40개 기관만 사용 가능, 나머지는 대기"라는 방식이다.

이 프로젝트는 Project Glasswing이라고 불린다.

Mythos의 성능은 얼마나 강력한가

먼저 데이터를 살펴보자.

벤치마크Claude Opus 4.6Claude Mythos변화
SWE-bench Verified80.8%93.9%+13.1%
SWE-bench Pro미공개77.8%현재 1위

SWE-bench Pro의 현재 2위는 지푸 GLM-5.1(58.4%), 3위는 GPT-5.4(57.7%)다. Mythos는 77.8%로 2위를 약 20%포인트 차이로 따돌렸으며, 그 격차는 결코 작지 않다.

하지만 Anthropic은 단순히 순위 경쟁만 하는 것이 아니다. Mythos로 실제 코드베이스를 스캔한 결과 다음과 같은 것들을 발견했다.

  • 주요 운영체제와 브라우저에서 수천 개의 제로데이 취약점
  • FFmpeg에 16년간 숨어 있던 오래된 버그——이 취약점은 기존 보안 스캔 도구로 500만 회 이상 스캔되었으나 모두 누락되었다

Cisco의 최고 보안 책임자 Anthony Grieco는 다음과 같이 말했다. "이는 심오한 패러다임 전환을 나타내며, 기존의 시스템 강화 방식으로는 더 이상 충분하지 않다는 명확한 신호입니다."

Project Glasswing의 논리는 무엇인가

Anthropic이 이 40개 기관에 제공하는 것은 Mythos의 프리뷰 버전 액세스이며, 용도는 단 하나, 방어적 사이버 보안 작업이다.

현재 액세스 권한을 획득한 파트너로는 Amazon, Apple, Broadcom, Cisco, CrowdStrike, Linux 재단, Microsoft, Palo Alto Networks가 포함된다.

Anthropic은 함께 다음을 제공한다.

  • 참여 기관의 보안 테스트 및 연구를 지원하는 1억 달러 상당의 API 크레딧
  • 오픈소스 보안 단체에 대한 400만 달러 직접 기부

왜 이런 '한정판' 형식을 취한 것일까.

공식 설명은 솔직하다. Mythos는 사이버 보안 능력에서 "현재 다른 어떤 AI 모델보다 훨씬 뛰어나지만", 바로 그렇기 때문에 대규모 사이버 공격을 가속화하는 데 악용될 수도 있다. Anthropic은 충분한 보호 조치 없이 이 모델을 공개하는 위험이 너무 높다고 판단했다.

그래서 그들이 선택한 절충안은 다음과 같다. 먼저 방어자에게 제공해 보안 팀이 사전에 패치를 적용할 수 있도록 한 후, 더 넓은 범위의 공개를 고려하겠다는 것이다.

이 전략은 옳은가

생각해볼 만한 가치가 있다.

전통적인 AI 모델 출시 논리는 출시, 테스트, 문제 발견, 수정, 반복이다. 이 과정은 공개되어 있으며, 위험은 확산된다——공격자와 방어자가 동시에 새 도구를 손에 넣는다.

Glasswing의 접근 방식은 이를 역전시킨다. 먼저 방어자에게 시간적 여유를 주고, Mythos로 적극적으로 취약점을 찾아 미리 수정하게 한 후, 더 넓은 액세스를 고려한다.

게임 이론 관점에서 이 설계는 타당하다. 방어자가 먼저 행동하면 공격자가 동일한 모델을 활용하는 비용이 훨씬 높아지기 때문이다.

하지만 실제 효과는 두 가지에 달려 있다. 이 40개 기관이 정말로 이 기간 내에 핵심 취약점을 수정할 수 있는지, 그리고 모델 자체의 능력에 유출 위험은 없는지(Mythos의 존재는 이미 데이터 유출 사건으로 인해 언론에 사전 노출된 바 있다).

Mythos는 어떤 수준의 모델인가

Anthropic은 명확히 "지금까지 가장 강력한 모델"이라고 밝혔으며, Opus 4.x 시리즈의 연장선상에 있는 반복이 아닌 새로운 세대의 모델이라고 설명했다.

몇 주 전, 데이터 유출 사건으로 인해 일부 언론이 Mythos의 존재를 사전에 폭로했다. Fortune은 Anthropic이 내부적으로 이를 "능력의 단계적 도약"이라고 표현했다고 보도했다. 이제 이름과 능력 모두 공식적으로 확정되었지만, 공개 출시가 아닌 대상 맞춤형 파트너십 프로그램의 형태로 이루어졌다.

Anthropic이 무엇을 기다리고 있는지는 명확히 밝혀지지 않았다. 그러나 SWE-bench Pro 77.8%라는 수치로 볼 때, 이 모델의 코드 능력은 이미 다른 차원에 있다.

출처: Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative (TechCrunch); Anthropic debuts Project Glasswing, CocoLoop, leveraging its powerful Mythos model to reinforce software security (SiliconAngle); Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses (Fortune); Exclusive: Anthropic Mythos AI model representing step change in power revealed in data leak (Fortune)