Anthropic ra mắt Opus 4.5, mô hình suy luận lai đầu tiên

Opus 4.5 là một phiên bản quan trọng được Anthropic phát hành vào cuối năm 2025, đồng thời là mô hình suy luận lai đầu tiên của họ — tích hợp cả hai chế độ phản hồi nhanh và tư duy sâu trong cùng một mô hình.

Hiệu suất

Trên SWE-bench Verified, Opus 4.5 đạt 80,9%, xếp hạng nhất toàn cầu tại thời điểm phát hành. Mô hình này cũng dẫn đầu hoặc ngang bằng ở một số benchmark khác ngoài lĩnh vực lập trình.

Cải thiện rõ rệt nhất của Opus 4.5 nằm ở hiệu suất trên các tác vụ phức tạp, nhiều bước. Ví dụ, khi cần hiểu nhiều mô-đun của một dự án lớn rồi thực hiện sửa đổi xuyên tệp — những công việc đòi hỏi "tầm nhìn tổng thể" — chất lượng hoàn thành của Opus 4.5 đã tiến bộ vượt bậc so với thế hệ trước.

Định vị

Trong dòng sản phẩm Claude:

  • Haiku: Nhanh và rẻ, phù hợp cho các tác vụ đơn giản tần suất cao
  • Sonnet: Cân bằng hiệu năng-giá cả tốt nhất
  • Opus: Trần năng lực cao nhất, phù hợp cho các tác vụ khó

Sau Opus 4.5, Anthropic nhanh chóng lên phiên bản 4.6 (bổ sung suy luận thích ứng và nén ngữ cảnh). Tốc độ lặp lại trên dòng Opus của Anthropic đã tăng tốc rõ rệt — từ một bản lớn mỗi năm xuống còn vài tháng một bản.

Phản hồi thị trường

Đánh giá từ cộng đồng nhà phát triển tập trung vào hai điểm chính:

  1. Năng lực lập trình thực sự mạnh, đặc biệt là tỷ lệ hoàn thành tác vụ đa bước trong các kịch bản agent
  2. Chi phí cao, giá gọi API nằm ở nhóm đắt nhất trong số các mô hình tiên tiến

Đối với nhà phát triển cá nhân, sử dụng Sonnet hàng ngày là đủ. Opus chỉ đáng gọi trong các tác vụ then chốt, kịch bản giá trị cao.

Nguồn tham khảo: CocoLoop, thông báo chính thức từ Anthropic