4월 20일, 알리바바가 Qwen 시리즈 사상 가장 강력한 모델인 Qwen3.6-Max-Preview를 출시했다.
주목할 점은 이번 출시에 대대적인 오픈소스 축하 행사도, Apache 라이선스 공지도, 무료 다운로드나 상업적 사용을 환영하는 배너도 없었다는 것이다. Qwen3.6-Max는 Qwen Studio와 알리바바 클라우드 Model Studio API를 통해서만 접근할 수 있으며, 가중치는 공개되지 않았다.
이는 알리바바 AI 전략의 전환점이며, 주목할 만한 사건이다.
벤치마크 결과: 6개 부문 1위, 종합 2위
먼저 성적을 살펴보자. Qwen3.6-Max는 다음 6개 주요 벤치마크에서 1위를 차지했다:
| 벤치마크 | 평가 내용 |
|---|---|
| SWE-bench Pro | 실제 소프트웨어 엔지니어링 작업 |
| Terminal-Bench 2.0 | 명령줄 실행 능력 |
| SkillsBench | 일반 문제 해결 |
| QwenClawBench | 도구 호출 |
| QwenWebBench | 웹 상호작용 |
| SciCode | 과학 프로그래밍 |
Artificial Analysis의 독립 평가 결과, 이 모델은 종합 2위로 선정되었다. Meta의 Muse Spark에 이어 2위이며, 동일 가격대의 다른 추론 모델 중앙값을 크게 웃돈다.
이전 세대인 Qwen3.6-Plus와 비교해 Max 버전은 SuperGPQA(고난도 종합 추론)에서 2.3%, 중국어 언어 테스트인 QwenChineseBench에서 5.3% 향상되었다. 이는 문제를 바꾸거나 점수를 높이기 위한 것이 아닌 실제적인 발전이다.
기술 사양
컨텍스트 윈도우: 256k 토큰. 이는 Qwen3.6-Plus의 100만 토큰보다 훨씬 작다. 알리바바는 여기서 트레이드오프를 선택했으며, 더 짧은 윈도우를 통해 더 높은 추론 품질을 얻었다.
입력 형식: 현재 텍스트만 지원하며 이미지는 지원하지 않는다. 최강 모델로서는 다소 예상 밖이지만, Preview 버전 이후에 추가될 것으로 보인다.
API 호환성: OpenAI와 Anthropic의 API 사양을 모두 호환하므로 전환 비용이 매우 낮다.
Preserve_thinking: 주목할 만한 새 기능이다. 모델이 여러 대화 턴에 걸쳐 추론 궤적을 유지할 수 있다. 매번 처음부터 추론을 시작하는 대신 이전에 어떻게 추론했는지 기억한다. 긴 흐름이나 다단계 상호작용이 필요한 시나리오에 유용하다.
핵심 질문: 오픈소스 강자가 왜 갑자기 플래그십을 클로즈드소스로 전환했나
Qwen 시리즈는 이전까지 전형적인 오픈소스 노선을 걸어왔다. Qwen3는 Apache 라이선스를 사용했고, Qwen3.6-35B-A3B는 4월 16일에 막 오픈소스화되어 가중치까지 공개되었다.
하지만 Max는 이번에 다르다.
알리바바가 이 길을 처음 걷는 것은 아니다:
- Meta는 Llama의 오픈소스로 개발자 생태계를 구축한 후, 슈퍼 인텔리전스 연구소의 첫 번째 클로즈드소스 플래그십으로 Muse Spark를 출시했다.
- 이제 알리바바도 가장 강력한 지점에 선을 그었다.
그 배경에는 이해하기 쉬운 논리가 있다. 오픈소스는 시장 점유율을 확보하고 생태계를 구축하며 개발자를 내 편으로 만드는 데 적합하다. 하지만 최상위 모델이야말로 대형 고객을 유치하고 서비스 요금을 징수할 수 있는 진정한 자산이다. 소형 모델은 오픈소스로, 대형 모델은 유료로 하는 전략은 2026년에 이미 주류가 되었다.
실제로 업계 전체가 이 방향으로 수렴하고 있다: OpenAI의 클로즈드소스 플래그십, Meta의 클로즈드소스 Muse Spark, 알리바바의 클로즈드소스 Max. 완전히 개방된 상태를 유지하는 곳은 주로 중소 규모의 연구소와 명확한 이념을 가진 프로젝트뿐이다.
개발자에게 미치는 영향
좋은 소식: API가 OpenAI 및 Anthropic 인터페이스와 호환된다. 이미 둘 중 하나를 사용하고 있다면 전환에 거의 코드 변경이 필요하지 않다.
나쁜 소식: 로컬 배포가 불가능하다. 데이터 프라이버시 요구 사항이 높거나, 저지연이 우선시되거나, 오프라인 실행이 필요한 시나리오에서는 Max가 선택지가 아니다. 이런 경우 계속 Qwen3.6-35B-A3B를 사용해야 한다.
중립적 소식: 256k 컨텍스트는 대부분의 실제 작업에 충분하다. 100만 토큰 윈도우는 인상적이지만 실제로 완전히 사용하는 시나리오는 많지 않다. Max는 자원을 추론 품질에 집중했으며, 이 트레이드오프는 합리적이다.
향후 전망
현재 Max-Preview는 프리뷰 상태다. 관례에 따르면:
- 이미지 지원은 정식 버전에서 추가될 것이다.
- 가격 전략은 아직 발표되지 않았으며, 공개 베타 기간 동안 가격은 없다.
- 오픈소스 소형 모델 체계(35B-A3B 등)는 정상적으로 유지되며 중단되지 않는다.
알리바바의 AI 전략은 광범위한 네트워크를 구축해 생태계를 만드는 단계에서 오픈소스로 사용자를 유치하고 클로즈드소스로 수익을 창출하는 단계로 전환되고 있다. 2026년 AI 시장에서 이는 거의 필연적인 선택이다. 순수 오픈소스로 일정 규모에 도달하면 상업화 경로가 매우 좁아지기 때문이다.
오픈소스라는 이유로 Qwen을 선택한 개발자라면 이 변화를 주목할 필요가 있다. 플래그십은 클로즈드되었지만 소형 모델은 남아 있다. 어떻게 사용할지는 사용자의 시나리오에 달려 있다.
출처: CocoLoop, Alibaba Drops Qwen 3.6 Max Preview—Its Most Powerful Model Yet (Decrypt)