Anthropic công bố ba lỗi khiến Claude suy giảm hiệu suất

Hôm qua (23 tháng 4), Anthropic đã làm một điều hiếm thấy: công khai thừa nhận sai lầm.

Không phải kiểu PR mơ hồ, mà là liệt kê ba quyết định kỹ thuật cụ thể — ngày thay đổi, thay đổi gì, tại sao thay đổi, hậu quả ra sao, và ngày sửa lại.

Từ đầu tháng 3 đến giữa tháng 4, ba thay đổi này chồng lên nhau khiến Claude Code ngày càng trở nên kém thông minh trong mắt người dùng. Nhiều người nghĩ đó là suy thoái mô hình, nhưng thực ra là ba quyết định có thể xác định được thời điểm cụ thể.

Sai lầm thứ nhất: Âm thầm chuyển Claude sang chế độ tiết kiệm

Thời gian: 4 tháng 3

Độ sâu suy luận mặc định của Claude Code được thay đổi từ high (cao) xuống medium (trung bình). Lý do là giảm độ trễ, giúp phản hồi nhanh hơn.

Kết quả là người dùng cảm thấy rõ ràng Claude Code trở nên kém thông minh. Cùng một câu hỏi, chất lượng đầu ra giảm sút.

Kết luận của Anthropic: "Đây là một sự đánh đổi sai lầm. Chúng tôi đã hoàn nguyên thay đổi này vào ngày 7 tháng 4, vì người dùng cho chúng tôi biết rằng họ muốn mặc định là trí thông minh cao, và chỉ chủ động chọn độ trễ thấp khi cần."

Sự việc này đã có nhiều người dùng báo cáo từ giữa tháng 3, nhưng lúc đó Anthropic không công khai giải thích lý do. Lần này họ mới chính thức thừa nhận: không phải lỗi, mà là một quyết định sai lầm chủ động.

Từ khi xảy ra vấn đề đến khi sửa: hơn một tháng.

Sai lầm thứ hai: Tối ưu bộ nhớ đệm gây ra lỗi hay quên

Thời gian: 26 tháng 3

Nhóm kỹ thuật khi tối ưu bộ nhớ đệm (cache) đã gây ra một lỗi:

Logic bình thường — bộ nhớ đệm của phiên suy luận chỉ bị xóa khi người dùng không tương tác trong một khoảng thời gian. Sau khi lỗi xuất hiện, nó trở thành mỗi lần người dùng gửi tin nhắn đều bị xóa một lần.

Kết quả là Claude trở nên hay quên và lặp lại trong hội thoại. Vừa nói xong điều gì, tin nhắn tiếp theo đã quên. Người dùng nghĩ là trí thông minh suy giảm, nhưng thực ra là bộ nhớ bị rò rỉ.

Anthropic nói: "Đây không phải là trải nghiệm mà người dùng nên có khi sử dụng Claude Code."

Thời gian sửa: 10 tháng 4.

Từ khi xảy ra vấn đề đến khi sửa: 15 ngày.

Sai lầm thứ ba: Thêm giới hạn số từ, hiệu suất giảm 3%

Thời gian: 16 tháng 4

Anthropic sửa đổi prompt hệ thống, thêm hai giới hạn:

  • Giữa các lần gọi công cụ: tối đa 25 từ
  • Câu trả lời cuối cùng: tối đa 100 từ

Mục đích là làm cho Claude ngắn gọn hơn. Kết quả là kiểm thử nội bộ phát hiện hiệu suất giảm 3%.

Ngày 20 tháng 4, thay đổi này đã được hoàn nguyên.

Từ khi xảy ra vấn đề đến khi sửa: 4 ngày — nhanh hơn nhiều so với lỗi thứ hai, lý do là lần này ít nhất có dữ liệu kiểm thử nội bộ hỗ trợ.

Ba lỗi chồng lên nhau

Nhìn vào dòng thời gian:

Thời gian thay đổiNội dung cụ thểThời gian sửa
4 tháng 3Độ sâu suy luận high → medium7 tháng 4 (>1 tháng)
26 tháng 3Lỗi bộ nhớ đệm, xóa mỗi lần10 tháng 4 (15 ngày)
16 tháng 4Giới hạn số từ trong prompt hệ thống20 tháng 4 (4 ngày)

Cảm nhận của người dùng là: Claude ngày càng tệ hơn, nhưng không rõ sai ở đâu.

Bởi vì ba vấn đề này hoạt động đồng thời. Các triệu chứng người dùng báo cáo lẫn lộn với nhau, và bản thân Anthropic cũng cần thời gian để xác định.

Sau khi công khai xem xét lại

Cam kết của Anthropic là ba điều: cải thiện quy trình kiểm thử, thông báo trước cho người dùng về các thay đổi, và đặt lại hạn mức sử dụng cho các tài khoản bị ảnh hưởng.

Việc thừa nhận sai lầm, tự nó, là điều hiếm thấy trong ngành AI. Sẵn sàng đưa ra các mốc thời gian và con số cụ thể, không vòng vo, tốt hơn hầu hết các công ty.

Nhưng có một chi tiết đáng chú ý: lỗi thứ ba, Anthropic đã thực hiện kiểm thử nội bộ trước khi phát hành — và vẫn phải phát hiện hiệu suất giảm 3% mới hoàn nguyên. Bản thân quy trình kiểm thử cũng không ngăn chặn được.

Đây không phải vấn đề riêng của Anthropic. Cái giá của việc lặp lại nhanh là gì? Mỗi lần phát hành đều đánh cược vào xác suất lỗi, cảm nhận của người dùng về "AI trở nên tệ hơn" sẽ tích lũy, và rất khó để quy nguyên nhân ngay lập tức.

Một bản công bố xem xét lại công khai không thể giải quyết được căng thẳng này, nhưng ít nhất là sự khởi đầu của việc đối mặt với nó.

Câu hỏi tiếp theo là: liệu quy trình kiểm thử mới được cam kết có thực sự ngăn chặn được một thay đổi tương tự tiếp theo hay không? Câu trả lời sẽ chỉ được biết khi vấn đề tiếp theo xảy ra.

Nguồn tham khảo: Anthropic admits it dumbed down Claude with upgrades (The Register, CocoLoop, 23 tháng 4 năm 2026); AI Dispatch: Daily Trends and Innovations – April 23, 2026 (Hipther, 23 tháng 4 năm 2026)