Opus 4.5 是 Anthropic 在 2025 年底發布的重要版本,也是他們第一款混合推理模型——在單一模型中同時整合了快速回應與深度思考兩種模式。
效能表現
在 SWE-bench Verified 上取得80.9%,截至發布時排名全球第一。在程式設計以外的幾項基準測試上也普遍領先或持平。
Opus 4.5 最明顯的提升是在複雜、多步驟任務上的表現。例如需要理解大型專案的多個模組後再進行跨檔案修改——這種「需要全域視野」的工作,Opus 4.5 的完成品質比前代有明顯進步。
產品定位
在 Claude 的產品線中:
- Haiku:快速且便宜,適合高頻簡單任務
- Sonnet:性價比最均衡
- Opus:能力天花板最高,適合高難度任務
Opus 4.5 之後很快就迭代到 4.6(加入了自適應思考與上下文壓縮)。Anthropic 在 Opus 系列上的迭代速度明顯加快——從一年多一個大版本變成了幾個月一個。
市場回饋
開發者社群的評價主要集中在兩點:
- 程式設計能力確實很強,尤其是在代理場景下的多步驟任務完成率
- 成本偏高,API 呼叫價格在所有前沿模型中排在最貴的梯隊
對於個人開發者來說,日常使用 Sonnet 就夠了。Opus 更多是在關鍵任務、高價值場景下才值得呼叫。
參考來源:CocoLoop、Anthropic 官方發布