Kimi K2.6 Code 출시, Claude Sonnet보다 5배 저렴

4월 13일, Moonshot AI는 모든 Kimi Code 구독자에게 K2.6 코드 프리뷰 버전을 전체 배포했습니다. 약 1주일간의 클로즈드 베타를 거친 후 정식으로 확대되었으며, GPT-5.4-Cyber와 Anthropic Mythos 출시 후 2주도 채 지나지 않은 시점에 이루어졌습니다.

Moonshot은 발표 행사나 긴 블로그 게시물을 준비하지 않았습니다. 이메일 한 통으로 Kimi Code가 업그레이드되었습니다.

K2.5와 비교하여 K2.6은 세 가지 개선 사항을 내세웁니다: 더 깊은 추론 체인, 더 명확한 멀티스텝 에이전트 계획, 그리고 더 안정적인 도구 호출 실행입니다. 실제 효과는 여러 파일에 걸친 대규모 리팩토링이나 복잡한 에이전트 워크플로우를 분해할 때 오류율이 낮아지고 논리가 더 일관성 있게 개선된 점에서 나타납니다.

가격이 진정한 킬러 기능

벤치마크 결과가 나오기도 전에 가격 책정이 먼저 사람들을 놀라게 했습니다.

모델 입력 (백만 토큰당) 출력 (백만 토큰당)
Kimi K2.6 $0.60 $2.50
Claude Sonnet 4.6 $3.00 $15.00
GPT-5.4 $2.50 $10.00

입력은 5배, 출력은 6배 저렴합니다. 구체적인 숫자로 계산해보면: 중소 규모 팀이 매월 1억 개의 입력 토큰과 1000만 개의 출력 토큰을 처리할 경우, 연간 약 4380달러를 절약할 수 있습니다. API 호출 비용을 실제 운영 지출로 간주하는 팀에게 이는 적지 않은 금액입니다.

K2.5의 벤치마크 점수는 76.8%(SWE-Bench Verified)와 85%(LiveCodeBench)로, 모든 오픈 웨이트 모델 중 최상위권에 속했습니다. K2.6의 공식 벤치마크는 아직 발표되지 않았지만, 클로즈드 베타에 참여한 개발자들은 K2.6의 출력이 "Opus의 느낌이 난다"고普遍적으로 보고했습니다. 즉, 상세한 추론 체인, 구조화된 사고 과정이 Claude의 verbose chain-of-thought와 다소 유사하다는 것입니다.

Agent Swarm: 진정한 병렬화

K2.6에서 가장 실질적인 기술적 변경은 Agent Swarm 계층의 재구성입니다.

Kimi의 Agent Swarm은 최대 100개의 하위 에이전트가 병렬로 작업할 수 있는 메커니즘입니다. K2.5에는 오래된 문제가 있었습니다: 오케스트레이터(총 조정자)가 이론적으로는 병렬 처리를 지원했지만, 실제 실행에서는 종종 순차 처리로 퇴화했습니다. K2.6은 이에 대한 특화 최적화를 적용하여 오케스트레이터가 기본적으로 퇴화하지 않고 진정한 병렬 실행을 유지할 수 있게 되었습니다.

결과는 병렬화 가능한 작업에서 최대 4.5배의 속도 향상입니다. 데이터 배치 처리, 멀티스텝 테스트, 병렬 검색 집계를 실행하는 경우 그 차이를 확실히 느낄 수 있습니다.

프론트엔드 코드 생성도 개선되었습니다. 코드가 작동할 뿐만 아니라 레이아웃과 시각적 논리도 더 일관성 있게 되었습니다.

오픈 웨이트, 로컬 실행 가능

K2.6은 수조 개의 파라미터를 가진 MoE 아키텍처를 기반으로 하며, Moonshot의 일관된 오픈 웨이트 정책을 유지합니다. 데이터가 외부로 나가지 않는 로컬 배포가 필요하거나 자체 추론 클러스터에서 실행하려는 경우 이론적으로 지원됩니다.

하지만 현재 완전한 오픈 웨이트 버전은 아직 완전히 출시되지 않았으며, 주로 API와 Kimi Code 구독을 통해 제공됩니다. 완전한 오픈 웨이트는 2026년 5월경에 출시될 것으로 예상됩니다.

프라이빗 환경에서 대규모 코드 에이전트를 실행해야 하는 팀에게 이 시점은 주목할 만합니다.

몇 가지 실제적인 단점

현실은 모든 것이 완벽하게 정리된 것은 아닙니다.

  • CLI가 며칠 늦어짐: API와 웹 인터페이스가 먼저 K2.6으로 업그레이드되었고, 명령줄 사용자는 약 3일을 기다려야 했습니다. 많은 개발자에게 CLI는 주요 진입점입니다.
  • 버전 이름이 혼란스러워지기 시작함: K2, K2.5, K2.6, K2.6-code-preview, K2.6-instruct… 어떤 엔드포인트가 어떤 버전을 실행 중인지 파악하기 어렵고, 버전 고정이 운영 부담이 되고 있습니다.
  • 영어 문서가 아직 따라잡지 못함: Anthropic 및 OpenAI와 비교하여 Moonshot의 영어 기술 문서 품질과 업데이트 속도는 아직 뒤쳐져 있습니다. 국제 개발자의 사용자 경험이 좋지 않습니다.
  • API 호출 빈도 제한: 5시간당 300~1200회는 고동시성 배치 작업에 충분하지 않으며, 자체 큐잉이 필요합니다.

K3는 아직 개발 중

K2.6이 나왔지만 K3에 대한 논의는 멈추지 않았습니다. 커뮤니티에 떠도는 소문에 따르면 K3의 목표 파라미터 수는 3~4조 규모에 달하며, 최고 수준의 미국 모델과 경쟁하는 것을 목표로 합니다. Moonshot은 3월 말에 K3가 개발 중임을 공식 확인했지만 구체적인 기능은 공개하지 않았습니다.

K2.6의 배포 방식(이메일 한 통, 그리고 직접 푸시)은 Moonshot이 비교적 조용한 방식으로 반복 개발을 진행하고 있음을 보여줍니다. 큰 뉴스를 만들지 않고, 먼저 사용자가 개선을 느끼게 하는 것입니다. 이는 K3가 "큰 것을 준비 중"이라는 소문과 모순되지 않습니다.

개발자에게 현재 상태는 이렇습니다: 가격이 합리적이고, 벤치마크도 괜찮으며, 단점이 수용 가능하다면 일단 사용해보는 것입니다. K3가 나오면 재평가하면 됩니다.

출처: Kimi Code K2.6: Key Takeaways for Developers (BuildFastWithAI); Kimi K2.6 Code Preview Is Here (kimi-k2.org); Moonshot's Kimi K2.5 is open, CocoLoop, 595GB, and built for agent swarms (VentureBeat)