Anthropicは10月7日、Claude Haiku 5.5を発表した。Claude第5世代として初となる小型モデルで、前バージョンのHaikuは4.5で止まっていた。新モデルは発表当日からClaude Platformで利用可能になり、同時にAWS、Google Cloud、Microsoft Azureにも展開された。Claude Codeも同日のリリースでこのモデルに対応した。
公式が示す用途は狭く絞られている。高スループットのバッチ処理と、大型モデルが呼び出すサブエージェント用途だ。今回の発表の主役は価格である。
プロンプトの長さで分かれる二段階の価格設定
Haiku 5.5は1回のプロンプトの長さによって価格を2段階に分けており、境界線は10万トークンだ。
| 100万トークンあたり | Haiku 5.5(10万以下) | Haiku 5.5(10万超) | Haiku 4.5 |
|---|---|---|---|
| 入力 | 0.10ドル | 0.50ドル | 1.00ドル |
| 出力 | 0.50ドル | 2.50ドル | 5.00ドル |
| キャッシュ読み取り | 0.01ドル | 0.05ドル | 0.10ドル |
| キャッシュ書き込み | 0.125ドル | 0.625ドル | 1.25ドル |
短いプロンプトの段階では、各項目の単価はHaiku 4.5の10分の1。長いプロンプトの段階では半額になる。Anthropicの説明では、総合的な運用コストは平均で約75%下がるという。
短い段階の入力・出力価格は、OpenAIが9月下旬に発表したGPT-6 Lunaとまったく同じだ。両社の小型モデルは価格表上でほぼ同じ線に並んだことになる。
同日、AnthropicはSonnet 5.5のキャッシュ読み取り価格を100万トークンあたり0.20ドルから0.10ドルに引き下げたうえ、サブスクリプション利用者にAPIクレジットを配布した。Max 5xは月100ドル、Max 20xは月200ドル、Teamプランはチーム全体で最大月500ドルだ。開発者のSimon Willisonはブログで、このクレジットは当月中に使い切らないと翌月に繰り越されないと指摘している。
ベンチマークと推論レベル
Haiku 5.5は推論機能を標準搭載しており、オフにはできないが、low、medium、high、xhigh、maxの5段階で調整できる。デフォルトはmediumだ。公式発表の成績では、コンピュータ操作テストのOSWorld 2.1オフラインサブセットで72.4%、Terminal-Bench 4.0で39.2%、Humanity's Last Examではツールなしで45.9%、ツールありで57.4%を記録した。
一部の先行顧客は自社の内部データを公表した。Boxによると、新モデルは自社のテストセットでHaiku 4.5より11ポイント高く、レイテンシはおよそ半分だったという。
"Claude Haiku 5.5 scored 11 points higher than Haiku 4.5 at about half the latency."
(Claude Haiku 5.5はHaiku 4.5より11ポイント高く、レイテンシはおよそ半分だった。)
Asanaはレイテンシが30%以上改善したと報告し、HubSpotはこのテストで見た中で最高となる92.8%を記録したという。これらはいずれも顧客側の自己測定によるもので、テスト内容自体は公開されていない。
推論レベルはコストに大きく影響する。Simon Willisonは「自転車に乗ったペリカンを描く」という同じプロンプトを最低レベルと最高レベルで試した。lowでは約0.0009ドル・7秒、maxでは約0.034ドル・5分9秒かかり、1回あたりのコストは30倍以上の差が出た。
ざっくり計算:トークナイザーが値下げ分の一部を相殺する
価格表の外にも見落としやすい変数がある。Simon Willisonの指摘によれば、Haiku 5.5はトークナイザーを変更し、同じ文章でも分割されるトークン数がHaiku 4.5の約1.25倍になったという。
この係数で粗く計算すると、短いプロンプト段階の実質的な入力コストは「旧トークン」100万あたり0.125ドル相当になり、Haiku 4.5の1ドルと比べて約87%減とまだかなり大きい。長いプロンプト段階はそれほど良くなく、0.50ドル×1.25は0.625ドルで、下げ幅は約37%に縮む。
さらに標準で有効になっている推論を考慮すると、出力トークンは推論なしのHaiku 4.5よりいくらか増える。その増加量はレベルとタスクによって異なる。ベンチマークや抽出、ルーティングのような短い入力が中心のタスクを行うチームにとっては、モデルを切り替えればほぼそのままコスト削減になる。長い文書や長いコンテキストを頻繁に扱う場面では、切り替える前に自社のトラフィックで一度計算してみた方がよい。
安全性について、公式はHaiku 5.5のサイバーセキュリティ関連リクエストに対する制限はHaiku 4.5とSonnet 5.5の間にあり、生物分野の防護はSonnet 5系列と同等だとしている。関連する研究には別途、検証資格の申請が必要だ。
参考資料:AnthropicのClaude Haiku 5.5製品ページ、Simon Willisonのブログ、CocoLoop、SiliconANGLE。価格表の2段階の単価、キャッシュ価格、Haiku 4.5との比較はAnthropic公式の価格ページで確認し、Sonnet 5.5のキャッシュ読み取り価格の変更は公式発表に基づく。