Tin tức chấn động nhất trong giới AI đầu tháng 4 không phải là một công ty nào đó ra mắt mô hình mới, mà là ba đối thủ cạnh tranh khốc liệt là OpenAI, Anthropic và Google bất ngờ tuyên bố sẽ cùng nhau đối phó với các công ty AI Trung Quốc.
Cụ thể, ba công ty đã bắt đầu chia sẻ thông tin tình báo thông qua Frontier Model Forum (diễn đàn được thành lập vào năm 2023 bởi các công ty này cùng với Microsoft), nhằm mục tiêu chống lại "các cuộc tấn công chưng cất" — hành vi mà đối thủ sử dụng đầu ra từ mô hình lớn của bạn để huấn luyện mô hình nhỏ hơn của chính họ.
Ba công ty Trung Quốc bị nêu tên bao gồm: DeepSeek, Moonshot AI (công ty mẹ của Kimi) và MiniMax.
"Tấn công chưng cất" là gì?
Phương pháp này không phức tạp: nhồi nhét một loạt các prompt được thiết kế tinh vi vào mô hình mục tiêu, thu thập kết quả trả về, và sử dụng chúng để huấn luyện mô hình của riêng mình.
Bạn không cần biết kiến trúc mô hình của đối phương, không cần lấy được trọng số, vẫn có thể khiến mô hình của mình học được một lượng lớn cách suy luận và cấu trúc kiến thức của đối phương. OpenAI đã nghi ngờ điều này từ khi DeepSeek R1 ra mắt, Sam Altman từng công khai nói rằng DeepSeek đã "chưng cất không đúng cách mô hình GPT".
Hiện tại, Anthropic đã đưa ra con số cụ thể: ba công ty Trung Quốc này đã tương tác với Claude hơn 16 triệu lần thông qua khoảng 24.000 tài khoản giả mạo.
Đây không phải là hành vi của người dùng bình thường. 16 triệu lần là một hoạt động khai thác dữ liệu mang tính công nghiệp, có hệ thống, và được thực hiện thông qua một lượng lớn tài khoản giả mạo để tránh bị phát hiện bởi các điều khoản sử dụng của nền tảng.
Tại sao ba kẻ thù bỗng nhiên trở thành đồng minh?
Nói ba công ty này là đối thủ cạnh tranh còn là nói nhẹ — OpenAI và Anthropic tranh giành cùng một hợp đồng doanh nghiệp, Google cùng lúc đối đầu trực diện với cả hai.
Tuy nhiên, khi quy mô của vấn đề lớn đến mức các biện pháp phòng thủ của một công ty đơn lẻ không thể chống đỡ, sự cạnh tranh này tạm thời nhường chỗ. Cơ chế chia sẻ thông tin tình báo của Frontier Model Forum có nghĩa là: khi một công ty phát hiện ra một phương thức tấn công chưng cất mới, hai công ty kia có thể đồng bộ cập nhật chiến lược phòng thủ.
Anthropic đã làm gì trong sự hợp tác này? Họ đã ra mắt "Project Glasswing" — giới hạn quyền truy cập vào mô hình Claude Mythos có năng lực cao trong phạm vi các đối tác cụ thể, kèm theo các cơ chế phát hiện an ninh chặt chẽ hơn, và cam kết 100 triệu USD tín dụng sử dụng cho các đối tác an ninh phòng thủ như AWS, Google, Microsoft.
Các công ty Trung Quốc thực sự đã đánh cắp những gì?
Từ cáo buộc của Anthropic, các lĩnh vực bị chưng cất bao gồm: thị giác máy tính, sinh mã, suy luận phức tạp và nhiều hướng năng lực cốt lõi khác.
So sánh lộ trình sản phẩm của ba công ty này có thể hiểu rõ hơn:
| Công ty | Sản phẩm chính | Liên quan đến năng lực bị cáo buộc |
|---|---|---|
| DeepSeek | Mô hình suy luận dòng R | Khả năng suy luận phức tạp |
| Moonshot AI | Mô hình ngữ cảnh dài Kimi | Hiểu tài liệu, khả năng mã |
| MiniMax | Sinh video, đa phương thức | Hiểu thị giác |
Mỗi công ty có thể có trọng tâm chưng cất khác nhau, nhưng điểm chung là: không cần tốn hàng trăm triệu USD chi phí huấn luyện vẫn có thể đạt được năng lực gần với SOTA.
Điều này có ý nghĩa gì đối với AI nguồn mở?
Nhìn rộng ra, việc thành lập liên minh này ở một mức độ nào đó đánh dấu ngành AI bước vào "giai đoạn bảo vệ sở hữu trí tuệ".
Trước đây, mọi người đều nói về AI mở, nguồn mở, chia sẻ mô hình. Giờ đây, Anthropic trực tiếp hạn chế quyền truy cập vào mô hình mạnh nhất của mình, OpenAI cũng tăng cường thực thi các điều khoản sử dụng.
Nếu việc chống chưng cất trở thành hành động tiêu chuẩn của ngành, những nhà nghiên cứu và công ty nhỏ phụ thuộc vào việc gọi API để tối ưu hóa mô hình của mình cũng sẽ bị ảnh hưởng — làm thế nào để phân biệt "gọi API bình thường" và "thu thập chưng cất có hệ thống" vốn là một vấn đề khó giải quyết cả về mặt kỹ thuật lẫn chính sách.
Hiện tại, ba công ty Trung Quốc bị nêu tên đều chưa có phản hồi công khai nào về những cáo buộc này.
Nguồn tham khảo: CocoLoop, OpenAI, Anthropic, Google Unite to Combat Model Copying in China (Bloomberg); OpenAI, Google, Anthropic Unite Against AI Model Theft (Built In); OpenAI, Anthropic and Google Unite Against China AI Distillation (resultsense.com)