Anthropic 發布 Opus 4.5,首款混合推理模型

Opus 4.5 是 Anthropic 在 2025 年底發布的重要版本,也是他們第一款混合推理模型——在單一模型中同時整合了快速回應與深度思考兩種模式。

效能表現

在 SWE-bench Verified 上取得80.9%,截至發布時排名全球第一。在程式設計以外的幾項基準測試上也普遍領先或持平。

Opus 4.5 最明顯的提升是在複雜、多步驟任務上的表現。例如需要理解大型專案的多個模組後再進行跨檔案修改——這種「需要全域視野」的工作,Opus 4.5 的完成品質比前代有明顯進步。

產品定位

在 Claude 的產品線中:

  • Haiku:快速且便宜,適合高頻簡單任務
  • Sonnet:性價比最均衡
  • Opus:能力天花板最高,適合高難度任務

Opus 4.5 之後很快就迭代到 4.6(加入了自適應思考與上下文壓縮)。Anthropic 在 Opus 系列上的迭代速度明顯加快——從一年多一個大版本變成了幾個月一個。

市場回饋

開發者社群的評價主要集中在兩點:

  1. 程式設計能力確實很強,尤其是在代理場景下的多步驟任務完成率
  2. 成本偏高,API 呼叫價格在所有前沿模型中排在最貴的梯隊

對於個人開發者來說,日常使用 Sonnet 就夠了。Opus 更多是在關鍵任務、高價值場景下才值得呼叫。

參考來源:CocoLoop、Anthropic 官方發布