Kimi K2.6 Codeが公開、Claude Sonnet比で5倍安い価格設定

4月13日、Moonshot AIはKimi Codeの全購読者に対してK2.6コードプレビュー版をプッシュ配信した。約1週間のクローズドベータを経て本格展開となり、GPT-5.4-CyberとAnthropic Mythosのリリースから2週間足らずでの投入となった。

Moonshotは発表イベントも長文ブログも行わなかった。メール1本でKimi Codeがアップグレードされた。

K2.5と比較して、K2.6は3つの改善点を打ち出している:より深い推論チェーン、より明確なマルチステップエージェント計画、そしてより信頼性の高いツール呼び出し実行。実際の効果としては、複数ファイルにまたがる大規模リファクタリングや複雑なエージェントワークフローの分解において、エラー率が低下し、論理の一貫性が向上している。

価格こそ真のキラーフィーチャー

ベンチマーク結果が出る前に、価格設定がまず衝撃を与えた。

モデル 入力(100万トークンあたり) 出力(100万トークンあたり)
Kimi K2.6 $0.60 $2.50
Claude Sonnet 4.6 $3.00 $15.00
GPT-5.4 $2.50 $10.00

入力は5倍安く、出力は6倍安い。具体的な数字で言えば、中小規模のチームが毎月1億トークンの入力と1000万トークンの出力を処理する場合、年間で約4380ドルの節約になる。API呼び出しコストを実際の運用経費として扱うチームにとって、これは無視できない金額だ。

K2.5のベンチマークスコアは76.8%(SWE-Bench Verified)と85%(LiveCodeBench)で、全オープンウェイトモデルの中でもトップクラスだった。K2.6の公式ベンチマークはまだ発表されていないが、クローズドベータに参加した開発者の間では、K2.6の出力には「Opusの風味がある」——詳細な推論チェーン、構造化された思考プロセスがClaudeのverbose chain-of-thoughtにいくぶん似ている——との声が広がっている。

Agent Swarm:真の並列処理へ

K2.6で最も実質的な技術的変更は、Agent Swarm層の再構築だ。

KimiのAgent Swarmは、最大100のサブエージェントを並列動作させる仕組み。K2.5には古くからの問題があった:オーケストレーター(全体調停者)は理論上並列処理をサポートしていたが、実際の実行では逐次処理に退化することが多かった。K2.6ではこの点に特化した最適化が施され、オーケストレーターがデフォルトで退化することなく真の並列実行を維持できるようになった。

結果として、並列化可能なタスクでは最大4.5倍の速度向上を実現。データバッチ処理、マルチステップテスト、並列検索集約などを実行している場合、その違いは顕著だ。

フロントエンドコード生成も改善された——コードが動くだけでなく、レイアウトとビジュアルロジックの一貫性も向上している。

オープンウェイト、ローカル実行可能

K2.6は兆パラメータ級のMoEアーキテクチャに基づいており、Moonshotが一貫して採用してきたオープンウェイトポリシーを維持している。データを外部に出さないローカルデプロイや、独自の推論クラスターで実行したい場合、理論的には対応可能だ。

ただし、現時点では完全なオープンウェイト版はまだリリースされておらず、主にAPIとKimi Codeサブスクリプションを通じて提供されている。完全なオープンウェイトは2026年5月頃の公開が見込まれている。

プライベート環境で大規模なコードエージェントを実行する必要があるチームにとって、このタイムラインは注目に値する。

いくつかの現実的な欠点

現実には、すべてが完全に整っているわけではない。

  • CLIが数日遅れた:APIとWebインターフェースが先にK2.6にアップグレードされ、コマンドラインユーザーは約3日間待たされた。多くの開発者にとってCLIが主要な入り口である。
  • バージョン名が混乱し始めている:K2、K2.5、K2.6、K2.6-code-preview、K2.6-instruct……どのエンドポイントがどのバージョンを実行しているか分かりにくく、バージョン固定が運用上の負担になっている。
  • 英語ドキュメントが追いついていない:AnthropicやOpenAIと比較して、Moonshotの英語技術ドキュメントの品質と更新速度はまだ劣っている。国際的な開発者のユーザー体験は良くない。
  • API呼び出し頻度制限:5時間あたり300〜1200回では、高並列バッチタスクには不十分で、独自のキューイングが必要。

K3はまだ開発中

K2.6がリリースされたが、K3に関する議論は止んでいない。コミュニティで流れる情報によれば、K3の目標パラメータ数は3〜4兆の規模に達し、トップクラスの米国モデルに対抗することを目指している。Moonshotは3月末にK3が開発中であることを公式に確認したが、具体的な機能は明らかにされていない。

K2.6のリリース方法——メール1本で直接プッシュ——は、Moonshotが比較的低調な方法で反復開発を進めていることを示している。大きな発表はせず、まずユーザーに改善を実感させる。これはK3が「大技を温存している」という噂と矛盾しない。

開発者にとっての現状はこうだ:価格は手頃で、ベンチマークもまずまず、欠点は許容範囲内なら、とりあえず使ってみる。K3が出たときに再評価すればよい。

出典:Kimi Code K2.6: Key Takeaways for Developers(BuildFastWithAI);Kimi K2.6 Code Preview Is Here(kimi-k2.org);Moonshot's Kimi K2.5 is open、CocoLoop、595GB、and built for agent swarms(VentureBeat)