Opus 4.5は、Anthropicが2025年末にリリースした重要なバージョンであり、同社初のハイブリッド推論モデルです。1つのモデルに高速応答と深い思考の両モードを統合しています。
パフォーマンス
SWE-bench Verifiedで80.9%を達成し、発表時点で世界1位にランクされました。コーディング以外の複数のベンチマークでも、概ねリードまたは同等の結果を示しています。
Opus 4.5の最も顕著な改善は、複雑で多段階のタスクにおけるパフォーマンスです。例えば、大規模プロジェクトの複数モジュールを理解した上でファイルをまたいだ修正を行うような「全体像を把握する必要がある」作業において、前世代と比較して完了品質が明らかに向上しています。
ポジショニング
Claudeの製品ラインにおける位置づけ:
- Haiku:高速かつ低コスト、高頻度の単純タスクに最適
- Sonnet:コストパフォーマンスが最もバランス良好
- Opus:能力の天井が最も高く、高難度タスク向け
Opus 4.5の後、すぐにバージョン4.6(適応的思考とコンテキスト圧縮を追加)へと反復されました。AnthropicはOpusシリーズの反復ペースを明らかに加速しており、年1回のメジャーバージョンアップから数ヶ月ごとの更新へと移行しています。
市場の反応
開発者コミュニティの評価は主に2点に集中しています:
- コーディング能力は確かに強い、特にエージェントシナリオにおける多段階タスクの完了率
- コストが高い、API呼び出し価格は最先端モデルの中で最も高額な層に位置
個人開発者にとっては、日常的な使用にはSonnetで十分です。Opusは重要なタスクや価値の高いシナリオでのみ呼び出す価値があります。
参考元:CocoLoop、Anthropic公式発表