Claude âm thầm giảm nỗ lực gây phẫn nộ cho người dùng

Gần đây, một nhóm người dùng nặng của Claude đã đồng loạt lên tiếng trên các diễn đàn, cho rằng mô hình đã trở nên "ngu hơn".

Không phải ẩn dụ, mà là thực sự nói về sự suy giảm hiệu năng. Một giám đốc cấp cao của AMD đã đăng trên Twitter rằng Claude hiện "không còn đáng tin cậy để xử lý các tác vụ kỹ thuật phức tạp". Trên Hacker News, một chủ đề đã được mở ra với hàng chục bình luận toàn là những lời phàn nàn giống nhau: không nghe lệnh, quy trình chạy sai, những việc trước đây làm được thì nay không còn làm được nữa.

Sau đó, phóng viên của Fortune đã điều tra và phát hiện Anthropic thực sự đã thay đổi điều gì đó ở hậu trường.

Họ đã làm gì

Anthropic đã âm thầm hạ mức "effort" (nỗ lực) mặc định của Claude từ "high" xuống "medium".

Tác động trực tiếp của sự điều chỉnh này là: số lượng token tiêu thụ cho mỗi yêu cầu giảm xuống, độ sâu suy luận trở nên nông hơn, chuyển từ phong cách "Research-first" (ưu tiên nghiên cứu) – trước đây là tìm hiểu ngữ cảnh trước rồi mới hành động – sang phong cách "Edit-first" (ưu tiên chỉnh sửa) – nhanh chóng đưa ra câu trả lời.

Bạn có thể hiểu đơn giản: cũng giống như làm bài tập, trước đây Claude sẽ đọc kỹ đề ba lần, hệ thống lại kiến thức liên quan rồi mới viết, còn bây giờ thì lướt qua một lượt rồi bắt đầu viết ngay. Những tác vụ phức tạp hơn đương nhiên dễ mắc lỗi hơn.

Boris Cherny, người phụ trách Claude Code, đã lên tiếng đáp trả, thừa nhận thay đổi này "được thực hiện dựa trên phản hồi của người dùng về mức tiêu thụ token".

Nhưng chính sự đáp trả này mới là vấn đề.

Vấn đề không phải là thay đổi, mà là cách thay đổi

Điều khiến mọi người thực sự bất mãn không phải là bản thân việc điều chỉnh hiệu năng, mà là Anthropic đã không chủ động thông báo cho người dùng.

Đối với người dùng API, những thay đổi về hành vi của mô hình lẽ ra phải được ghi lại trong tài liệu – nếu bạn thay đổi độ sâu suy luận, ít nhất hãy nói một tiếng trong release notes. Nhưng lần này, người dùng phải tự mình so sánh để phát hiện ra, chứ không phải được thông báo chính thức.

Hình ảnh thương hiệu của Anthropic từ trước đến nay luôn được xây dựng trên nền tảng "chúng tôi minh bạch hơn các công ty AI khác". Constitutional AI, Model Card, nghiên cứu Alignment được công bố rộng rãi… toàn bộ câu chuyện đối ngoại đều nhấn mạnh "chúng tôi là công ty AI có trách nhiệm". Thế mà, khi liên quan đến hiệu năng sản phẩm của chính mình, họ lại không thực hiện được việc tiết lộ thông tin cơ bản nhất.

Đáng xấu hổ hơn, sự việc này xảy ra đúng vào thời điểm doanh thu hàng năm của Anthropic vượt mốc 30 tỷ USD và giới bên ngoài bắt đầu thảo luận về khả năng IPO.

Giả thuyết về khủng hoảng năng lực tính toán

Giới trong ngành có một cách giải thích táo bạo hơn về sự điều chỉnh này: Anthropic có thể thực sự đang gặp khó khăn về năng lực tính toán.

So với OpenAI và Google, Anthropic không có nhiều thỏa thuận trung tâm dữ liệu riêng. OpenAI có Microsoft Azure, Google có cơ sở hạ tầng riêng, Meta thậm chí đã đốt gần 50 tỷ USD cho cơ sở hạ tầng AI. Anthropic dựa vào các dịch vụ đám mây bên ngoài của Amazon và Google, vốn ở thế bất lợi tự nhiên trong việc điều phối linh hoạt tài nguyên tính toán.

Hơn nữa, gần đây Anthropic thực sự đã xảy ra một số lần gián đoạn dịch vụ, cùng với việc thắt chặt giới hạn sử dụng trong giờ cao điểm – những dấu hiệu này ghép lại, giả thuyết về năng lực tính toán tuy chỉ là suy đoán, nhưng không phải là vô lý.

Một người trong nội bộ OpenAI thậm chí đã trả lời phỏng vấn báo chí rằng đây là "sai lầm chiến lược" của Anthropic khi không khóa đủ tài nguyên tính toán từ trước. Câu nói này có phải là đang nhân cơ hội "đâm sau lưng" hay không thì tùy quan điểm, nhưng ít nhất nó cho thấy mối lo ngại này thực sự tồn tại.

Mâu thuẫn cốt lõi của sự việc

Góc nhìnKỳ vọng của người dùngHành động thực tế của Anthropic
Thay đổi hiệu năngKhả năng mô hình chỉ tăng không giảmÂm thầm hạ cấp độ effort
Công bố thông tinPhải thông báo khi có thay đổi lớnChỉ thừa nhận khi bị chất vấn sau đó
Cam kết thương hiệuCông ty AI minh bạch nhất ngànhLần này rõ ràng không làm được

Nếu đây chỉ là một lần tối ưu hóa sản phẩm, mọi người sẽ phàn nàn vài ngày rồi thôi. Nhưng nó chạm đến một vấn đề căn bản hơn: khi một công ty AI bắt đầu cảm nhận áp lực thương mại, liệu họ có ưu tiên bảo vệ lợi nhuận hơn là bảo vệ lợi ích của người dùng hay không?

Nhóm người dùng cốt lõi của Claude – các nhà phát triển API nặng, người ra quyết định kỹ thuật doanh nghiệp – chính là những người nhạy cảm nhất với các vấn đề kiểu này. Họ không chỉ quan tâm đến khả năng hiện tại của mô hình, mà còn quan tâm đến những lựa chọn mà công ty này sẽ đưa ra dưới áp lực.

Cách xử lý tiếp theo của sự việc này, ở một mức độ nào đó, còn quan trọng hơn bản thân sự việc.

"Chúng tôi không phải không thể chấp nhận thay đổi, chúng tôi không thể chấp nhận là bị giấu diếm." – Bình luận trên Hacker News

Nguồn tham khảo: CocoLoop, Anthropic is facing a wave of user backlash over reports of performance issues with its Claude AI chatbot (Fortune)