Jackson Kernion, kỹ sư phụ trách tinh chỉnh (fine-tuning) Claude tại Anthropic, gần đây liên tục đăng nhiều bài trên X để giải thích vì sao nhiều người dùng cảm thấy Claude ngày càng thông minh hơn nhưng những gì nó viết ra lại ngày càng khó đọc. Cách nói của anh khá thẳng thắn: các mô hình sau này tập trung huấn luyện vào toán học và lập trình, đồng thời được huấn luyện rất nhiều để "viết tài liệu kỹ thuật cho các mô hình AI khác đọc", khiến mô hình dần thích nghi với "tâm lý của LLM", học cách viết cho AI đọc chứ không phải cho con người đọc.
Cuộc thảo luận bắt đầu từ việc người dùng trên mạng phàn nàn về khả năng viết của Claude, có người cho rằng Opus 4.6 là mô hình "viết lách" tốt cuối cùng của Anthropic. Kernion không phủ nhận cảm nhận này.
"Giọng văn Claude" đến từ đâu
Lời giải thích của Kernion nằm ở thiết kế phần thưởng trong học tăng cường. Một phần thưởng trong huấn luyện nhắm vào việc "một mô hình khác có hiểu được không", phần còn lại nhắm vào việc "con người có hiểu được không". Lượng huấn luyện toán học và lập trình càng lớn, tín hiệu loại đầu càng mạnh, mô hình càng có xu hướng viết ra những đoạn văn nén thông tin cực độ, chất đầy thuật ngữ. Về cảm nhận của người đọc, anh dùng một cụm từ: overly-dense info dumps — những "cú đổ thông tin" quá dày đặc.
Anh còn đưa ra một phép ví von: một nhóm người chỉ giao tiếp với nhau sẽ dần hình thành một lối diễn đạt rất trôi chảy trong nhóm nhưng khó hiểu với người ngoài. Giữa các mô hình với nhau cũng vậy.
Muốn sửa, phải chủ động tăng cường trong huấn luyện, thưởng cho những cách giải thích đơn giản mà độc giả con người có thể theo kịp. Kernion nói việc này khó làm, đội ngũ sẽ tiếp tục cải thiện.
Opus 5.5 đã thay đổi điều gì
Anh viết trong bài đăng:
"Opus 5.5 is our first model release with targeted improvements on sentence clarity and overly-dense info dumps." Opus 5.5 là phiên bản mô hình đầu tiên của chúng tôi có những cải thiện có mục tiêu về độ rõ ràng của câu văn và vấn đề đổ thông tin quá dày đặc.
Ngay sau đó anh nói thêm: kể từ Opus 4.6, anh chưa từng hài lòng với khả năng viết của một mô hình nào đến vậy. Cách nói này để ngỏ dư địa, anh không khẳng định Opus 5.5 đã vượt qua 4.6.
Khi Opus 5.5 ra mắt, truyền thông bên ngoài cũng nhắc đến việc Anthropic cam kết giảm bớt lối viết kiểu "Claudish". Người dùng tiếng Anh từng liệt kê những triệu chứng điển hình gồm: các cụm từ cố định lặp đi lặp lại, các tiêu đề phụ lồng nhau nhiều tầng, chia một việc thành quá nhiều gạch đầu dòng. Đây là những tổng kết từ phía người dùng, Anthropic chưa công bố một danh sách "giọng văn Claude" nào, cũng chưa công bố điểm đánh giá nào cho khả năng đọc hiểu của văn bản.
Ảnh hưởng gì đối với người dùng tiếng Trung
Những gì Kernion thảo luận đều xoay quanh bối cảnh tiếng Anh. Đầu ra tiếng Trung có xu hướng tương tự hay không, lần cải thiện có mục tiêu này có bao phủ tiếng Trung hay không, anh không đề cập, Anthropic cũng chưa có giải thích riêng.
Từ lời giải thích của anh có thể suy ra một điều: xu hướng này liên quan đến loại tác vụ. Tác vụ càng thiên về kỹ thuật, mô hình càng dễ chuyển sang chế độ "viết cho mô hình đọc". Các nhà phát triển trong nước dùng Claude để viết tài liệu API, viết bản mô tả giải pháp, viết chú thích mã nguồn, đúng là rơi vào phạm vi này.
Trước khi có số liệu chính thức phía tiếng Trung, ban biên tập đề xuất hai cách làm, đều thuộc kinh nghiệm thực tế: một là trong prompt nói rõ độc giả là ai, ví dụ "viết cho một quản lý sản phẩm mới vào nghề", cách này hiệu quả hơn câu "viết cho dễ hiểu"; hai là để mô hình viết kết luận trước rồi mới triển khai, giới hạn số điểm thông tin trong mỗi đoạn. Những đội đã chuyển sang dùng Opus 5.5 có thể lấy cùng một lô prompt cũ chạy lại, đối chiếu đầu ra thời 4.6 và thời 5.x, tự đánh giá mức độ cải thiện.
Nguồn tham khảo: bài đăng trên X của Jackson Kernion, The Decoder, CocoLoop, Ifeng Tech; chức danh và nguyên văn phát biểu của Kernion đã được đối chiếu theo bài đăng của chính anh và các bản tin truyền thông.