Ngày 8 tháng 9, Cơ quan An ninh Quốc gia Mỹ (NSA), Cơ quan An ninh mạng và Cơ sở hạ tầng (CISA) cùng Cục Điều tra Liên bang (FBI) đã công bố chung một cảnh báo an ninh, nêu tên sáu công ty trí tuệ nhân tạo Trung Quốc, cáo buộc họ dùng phương pháp "chưng cất" để trích xuất trên quy mô lớn năng lực độc quyền của các mô hình Mỹ tiên tiến, nhằm tăng tốc huấn luyện sản phẩm của chính mình. Trong các báo cáo công khai, ba cái tên được nêu rõ là DeepSeek, Moonshot AI và Alibaba.
Cảnh báo cho biết các mô hình bị nhắm tới đến từ Anthropic, OpenAI, Google và SpaceX; hành vi này "nhiều khả năng diễn ra với sự hiểu biết của chính phủ Trung Quốc"; các công ty này thực hiện hoạt động phân tán để tránh bị nhận diện trên một nền tảng duy nhất. Phía Mỹ còn viết rằng việc nâng cao năng lực kiểu này có thể tiếp tục củng cố năng lực quân sự và tấn công mạng của Trung Quốc.
Bản thân từ "chưng cất" không mang tội danh
Chưng cất là một kỹ thuật huấn luyện thông thường: lấy đầu ra của một mô hình lớn hơn, đắt hơn để huấn luyện một mô hình nhỏ hơn, tiết kiệm thời gian lẫn chi phí. Giới học thuật đã dùng kỹ thuật này nhiều năm, các phòng thí nghiệm cũng áp dụng nội bộ, và đây gần như là cách chính để nén mô hình lớn thành mô hình nhỏ chạy trên thiết bị đầu cuối.
Trọng tâm của cảnh báo không nằm ở phương pháp, mà ở việc có được cấp phép hay không và quy mô thực hiện. Cáo buộc của phía Mỹ là các công ty này đã làm việc này ở quy mô công nghiệp mà không được phép. Sự phân biệt này được viết rõ trong văn bản, nhưng dễ bị bỏ sót khi thuật lại. Bỏ sót nó thì thành ra "dùng chưng cất tức là ăn cắp" — điều đó không đúng.
Phần chưa được công bố
Phiên bản công khai của cảnh báo không liệt kê bằng chứng kỹ thuật cho các cáo buộc — nhật ký truy cập, danh tính tài khoản, con số cụ thể về quy mô trích xuất, tất cả đều không có. Cụm từ "nhiều khả năng diễn ra với sự hiểu biết của chính phủ Trung Quốc" dùng cách nói về khả năng, không phải kết luận khẳng định. Tính đến thời điểm đăng bài, các công ty bị nêu tên và phía chính quyền Trung Quốc đều chưa lên tiếng công khai, văn bản cũng không đề cập tới hành động thực thi pháp luật hay trừng phạt tiếp theo.
Với các doanh nghiệp, điều duy nhất có thể khẳng định là: điều khoản sử dụng của các nhà cung cấp mô hình Mỹ từ lâu đã cấm dùng đầu ra để huấn luyện mô hình cạnh tranh. Điểm khác biệt là, trước đây đây chỉ là một điều khoản hợp đồng, việc thực thi phụ thuộc vào nền tảng tự khóa tài khoản; còn bây giờ nó xuất hiện trong một cảnh báo chung của các cơ quan an ninh quốc gia, tính chất đã được nâng lên một bậc.
Thời điểm
Cảnh báo này được đưa ra trước hai sự kiện: Mỹ và Trung Quốc dự kiến thảo luận về rủi ro an toàn AI vào giữa tháng 9, và Chủ tịch Tập Cận Bình dự kiến thăm Mỹ vào cuối tháng 9. Cùng ngày, Bộ trưởng Tài chính Mỹ Scott Bessent công khai nói rằng nếu Mỹ thua Trung Quốc trong cuộc đua AI, hậu quả sẽ rất nghiêm trọng.
Với các công ty làm mô hình trong nước, tác động trực tiếp không đến từ bản thân cảnh báo này, vì nó không có hiệu lực pháp lý. Tác động nằm ở phía sau. Khi sản phẩm ra nước ngoài kết nối với đám mây Mỹ, lên các kho ứng dụng Mỹ, hay tiếp cận khách hàng doanh nghiệp Mỹ, bên mua rất dễ thêm một mục trong bảng câu hỏi tuân thủ: "dữ liệu huấn luyện mô hình của bạn có chứa đầu ra của mô hình bên thứ ba không". Một vài mô hình hàng đầu trong nước đúng lúc này đang đẩy mạnh vào thị trường doanh nghiệp nước ngoài, và mục này không dễ khai qua loa — nguồn gốc dữ liệu huấn luyện, nếu không giải thích rõ được thì coi như không giải thích được.
Một khó khăn khác nằm ở việc thu thập chứng cứ. Dấu vết của chưng cất nằm trong trọng số mô hình, không nằm trong tệp tin, nên bên thứ ba hiện chưa có phương pháp được công nhận rộng rãi để chứng minh hoặc bác bỏ. Giới học thuật những năm gần đây có đề xuất các phương án đánh dấu bản quyền (watermark) hay lấy dấu vân tay cho đầu ra mô hình, nhưng vẫn chỉ dừng ở giai đoạn nghiên cứu, chưa có phương án nào được chấp nhận làm bằng chứng. Đây cũng là lý do vì sao loại cáo buộc này thường dừng lại ở mức cảnh báo, hiếm khi đi đến kiện tụng.
Tác động có thể thấy được đối với người dùng trong nước hiện gần như bằng không: các sản phẩm bị nêu tên vẫn hoạt động bình thường, API và ứng dụng trong nước không có thay đổi. Điều cần lưu ý nằm ở phía bên kia — các nhà cung cấp mô hình Mỹ có thể siết chặt việc giám sát và khóa tài khoản đối với cách sử dụng đầu ra, các nhóm phát triển thứ cấp phụ thuộc vào API nước ngoài sẽ đối mặt rủi ro tài khoản cao hơn trước.
Nguồn tham khảo: Cảnh báo an ninh chung của NSA, CISA và FBI, Reuters, CocoLoop, United Daily News, Sing Tao Headline; số công ty bị nêu tên theo văn bản cảnh báo, các báo cáo công khai nêu rõ tên ba công ty, ba công ty còn lại chưa được công bố.