xAI, Google và Microsoft đều đã đồng ý đưa các mô hình AI frontier vào quy trình đánh giá an toàn trước khi phát hành của chính phủ Mỹ.
Ngày 5 tháng 5, ba công ty xác nhận tham gia cơ chế do CAISI, Trung tâm Tiêu chuẩn và Đổi mới AI thuộc Bộ Thương mại Mỹ, vận hành. Nói ngắn gọn, trước khi mô hình được công bố rộng rãi, nhà phát triển sẽ giao phiên bản cho các nhà khoa học chính phủ để kiểm tra rủi ro an ninh quốc gia.
CAISI làm gì
CAISI nằm trong Bộ Thương mại Mỹ. Nhiệm vụ hiện nay bắt nguồn từ cam kết của chính quyền Trump vào tháng 7 năm 2025 về việc hợp tác với các công ty công nghệ trong AI vetting.
Công việc cốt lõi là: đánh giá các mô hình AI frontier trước khi triển khai công khai và nhận diện rủi ro an ninh quốc gia. CAISI cho biết họ đã hoàn thành hơn 40 cuộc đánh giá mô hình frontier, tập trung vào tấn công mạng, lạm dụng quân sự và các năng lực nguy hiểm khác.
Giám đốc CAISI Chris Fall mô tả đây là vấn đề của khoa học đo lường: phép đo độc lập và nghiêm ngặt là nền tảng để hiểu AI frontier và tác động của nó đối với an ninh quốc gia.
Cơ chế này rất cụ thể. Doanh nghiệp không chỉ đưa phiên bản sản phẩm còn nguyên guardrail an toàn. Họ phải cung cấp mô hình nội bộ đã gỡ guardrail, để CAISI kiểm tra giới hạn năng lực thực sự.
Danh sách đã mở rộng ra sao
Dòng thời gian hiện nay như sau:
- Năm 2024: OpenAI và Anthropic ký các thỏa thuận tự nguyện đầu tiên.
- Tháng 7 năm 2025: Chính quyền Trump cam kết hợp tác với các công ty công nghệ trong AI vetting.
- Ngày 5 tháng 5 năm 2026: Microsoft, Google và xAI tham gia.
Microsoft nói họ sẽ cùng các nhà khoa học chính phủ thử nghiệm mô hình để phát hiện “hành vi ngoài dự kiến”. Cụm từ này quan trọng vì nó chỉ những năng lực chưa lộ ra trong huấn luyện nhưng xuất hiện sau khi triển khai.
Động thái của xAI đáng chú ý hơn. Elon Musk thường nói AI cần được quản lý, nhưng tài liệu của SpaceX cũng ghi rõ rủi ro tuân thủ của xAI. Việc trực tiếp tham gia CAISI là một bước nhượng bộ hiếm thấy từ xAI.
Áp lực thật sự đến từ Mythos
Thời điểm này không phải ngẫu nhiên. Anthropic gần đây công bố Mythos, một mô hình an ninh mạng được cho là đã tìm ra lỗ hổng trong OpenBSD tồn tại 27 năm mà chưa ai phát hiện, chỉ trong hai tuần. Sau đó Anthropic lập liên minh với 12 tập đoàn lớn, trình diễn cho lãnh đạo ngân hàng trung ương và khiến Jerome Powell, Scott Bessent cùng các lãnh đạo Phố Wall phải họp khẩn.
Mối lo bên trong CAISI là năng lực kiểu Mythos đã có thể khuếch đại năng lực của tin tặc. Nếu đã tới ngưỡng đó, không công ty AI hàng đầu nào nên phát hành mô hình mà bỏ qua đánh giá cấp quốc gia.
Đó là nền tảng thực sự của việc danh sách tăng từ hai lên năm công ty. CAISI không thể chỉ nhìn OpenAI và Anthropic khi Gemini của Google, Grok của xAI và dòng Phi của Microsoft cũng đã vượt qua ngưỡng năng lực tương tự.
Pentagon đi trên một đường khác
Còn một tuyến chính sách khác cần đặt cạnh để nhìn. CAISI là kênh đánh giá an toàn của Bộ Thương mại, còn Lầu Năm Góc xây dựng hợp tác mua sắm và triển khai.
Đầu tuần này, Lầu Năm Góc ký các thỏa thuận triển khai mạng mật với tám công ty AI. Anthropic không có trong danh sách, được cho là vì guardrail nghiêm ngặt của họ đối với mục đích quân sự khiến một số trường hợp sử dụng không thể thống nhất.
Bức tranh hiện tại là:
- Danh sách đánh giá CAISI: OpenAI, Anthropic, Microsoft, Google và xAI.
- Danh sách hợp tác của Lầu Năm Góc: tám công ty AI, không có Anthropic.
- Tòa án liên bang tuần trước cũng bác yêu cầu khẩn cấp của Anthropic liên quan đến lệnh cấm từ Bộ Quốc phòng.
Anthropic hợp tác với CAISI nhưng vẫn khó dùng trong kênh quốc phòng. OpenAI và Google có mặt ở cả hai tuyến.
Khung quản lý đang được ghép lại
Mỹ chưa có luật AI liên bang toàn diện. Tuy vậy, các công cụ như FTC, SEC, DOJ, CAISI, Lầu Năm Góc và sắc lệnh hành pháp của Nhà Trắng đang lần lượt được kích hoạt. Ở cấp bang, RAISE Act của New York đã hoàn tất, còn California và Texas đang đi theo.
Ý nghĩa của lần mở rộng danh sách CAISI là việc rà soát mô hình trước khi phát hành đã chuyển từ hành động tự nguyện của hai công ty thành chuẩn thực tế với các phòng lab AI hàng đầu. Nếu Nhà Trắng sau này biến nó thành yêu cầu bắt buộc bằng sắc lệnh hành pháp, cơ chế này sẽ trở thành điều kiện gia nhập thị trường.
Tốc độ ra mắt mô hình mới có chậm lại không? Khả năng cao là có. Một mô hình như GPT-5.5 có thể không còn đi từ thử nghiệm nội bộ tới ra mắt trong vài tuần nếu cần để trống thời gian cho CAISI kiểm tra. Nhưng với ngành AI, bước này có thể quan trọng hơn vẻ ngoài của nó: khi năng lực tiến nhanh như vậy, không ai kiểm tra mới là rủi ro thật sự.
Nguồn tham khảo: Microsoft, CocoLoop, xAI and Google will share AI models with US govt for security reviews (tổng hợp nhiều hãng tin, 2026-05-05); Pentagon strikes deals with 8 Big Tech companies after shunning Anthropic (CNN Business, 2026-05-01)