Moonshot AI ngày 11/9 thông báo trong ghi chú cập nhật của Kimi Code rằng K2.8 Preview đã lên sóng cho toàn bộ người dùng. Định vị chính thức gồm hai ý: hiệu năng tổng thể gần bằng K3, hiệu suất suy luận (thinking) cải thiện rõ so với K2.7 Code; năng lực lập trình và tác nhân (agent) đều được "nâng cấp toàn diện".
Lần đổi model này không đổi tên. ID model vẫn là kimi-for-coding, nên client Kimi Code và các công cụ bên thứ ba gọi vào ID này không cần sửa cấu hình — yêu cầu sẽ tự động rơi vào model mới.
Ba thay đổi có thể xác nhận
Thứ nhất là mức độ suy luận. K2.8 Preview hỗ trợ điều chỉnh thinking effort, các mức giống hệt K3, chia thành ba bậc low, high, max, mặc định là max.
Thứ hai là ngữ cảnh. Mọi gói thành viên đều được mở cửa sổ ngữ cảnh tối đa 1M token, không còn phân biệt theo gói.
Thứ ba là quy tắc định tuyến. Ghi chú cập nhật nêu rõ: sau khi tắt thinking, yêu cầu của cả dòng K3 lẫn K2.8 Preview đều được định tuyến về K2.8 Preview không suy luận. Nói cách khác, người dùng chọn K3 trong Kimi Code nhưng tắt thinking thực chất đang dùng K2.8 Preview.
Câu "gần bằng K3" hiện chưa đi kèm con số nào. Ghi chú cập nhật không có bảng điểm benchmark, không nói khi nào Preview chuyển thành bản chính thức, cũng không đề cập giá gói thành viên hay hạn mức có thay đổi theo hay không. Để so sánh, khi K2.7 Code ra mắt ngày 12/6, hãng từng công bố hai con số: Program-Bench tăng 10,4%, lượng token suy luận giảm 30%. K3 phát hành ngày 16/7, tổng tham số 2,8 nghìn tỷ, cửa sổ ngữ cảnh 1 triệu token.
Tên model không đổi, nhưng ai chịu ảnh hưởng thì khác nhau
kimi-for-coding giống như một bí danh cố định, model thực sự đứng sau do Moonshot AI quyết định. Với nhà phát triển cá nhân, điều này giúp bỏ qua bước đổi cấu hình.
Với người dùng đã tích hợp Kimi Code vào CI, script tự động hoặc công cụ lập trình dùng chung của cả team, tình hình khác hẳn: cùng một cấu hình nhưng từ hôm nay chạy trên một model khác, phong cách đầu ra, thời gian xử lý và lượng token tiêu thụ đều có thể thay đổi theo. Ghi chú cập nhật không nói rõ liệu có thể tiếp tục chỉ định K2.7 Code hay không.
Cuộc đua gói thuê bao lập trình ở Trung Quốc gần đây khá chật chội. Zhipu AI ngày 10/9 khởi động chương trình Coding toàn thành phố tại Hàng Châu, tặng trợ cấp cho gói Coding. Lần cập nhật này của Kimi không có mục giá, thứ đưa ra là model mới và cửa sổ ngữ cảnh 1M cho mọi gói.
Chế độ cấp quyền đổi hai lần chỉ trong hai ngày
Ngoài model, client dòng lệnh của Kimi Code cũng liên tục đổi logic cấp quyền từ đầu tháng này. Bản v0.40.0 ngày 2/9 đổi tên hai chế độ YOLO và Auto cũ thành "Tự động hoàn toàn" (/never-ask) và "Hỏi khi cần" (/ask-when-needed), còn Manual đổi thành "Luôn hỏi"; đồng thời thêm một lớp bảo vệ tích hợp sẵn: các lệnh như shutdown, reboot, rm -rf sẽ bị từ chối thẳng khi ở chế độ tự động hoàn toàn, các chế độ khác phải được người dùng xác nhận trước khi thực thi.
Hai ngày sau, bản v0.41.0 viết: "Lệnh nguy hiểm không còn bị chặn. Chế độ cấp quyền tự động không còn chặn các lệnh nguy hiểm và lệnh không thể phân tích tĩnh." Tài liệu không giải thích lý do đổi ngược lại, cũng không nói rõ "chế độ cấp quyền tự động" ở đây chỉ tính mức "Tự động hoàn toàn", hay tính cả mức "Hỏi khi cần".
v0.41.0 cùng lúc thêm hai tính năng cho bản Web: Tower — cộng tác đa tác nhân dạng thử nghiệm (khởi động bằng /tower), và tính năng bôi đen văn bản để ghi chú trong tin nhắn, xem trước file và diff. Ở bản trước đó nữa, bể model cho sub-agent đã chuyển từ tính năng thử nghiệm thành tính năng chính thức, cho phép cấu hình một nhóm model ứng viên.
Với các team đặt Kimi Code ở chế độ tự động hoàn toàn và chạy trong môi trường không giám sát, việc lệnh xóa hay tắt máy có bị chặn hay không giờ phải tự kiểm tra trên đúng phiên bản client đang dùng. Moonshot AI hiện chưa có thông báo riêng về thay đổi này.
Nguồn tham khảo: Ghi chú cập nhật chính thức của Kimi Code (các mục K2.8 Preview, v0.40.0, v0.41.0), IT Home, CocoLoop; các thông số và số liệu kiểm thử của K3 và K2.7 Code theo công bố chính thức của Moonshot AI.