Một AI tự tìm lỗ hổng
Trước hết là con số. Khi thử nghiệm Mythos Preview, Anthropic phát hiện: mô hình này có thể tái tạo và khai thác lỗ hổng thành công ngay lần đầu trong 83,1% trường hợp. Để so sánh, Claude Opus 4.6 của cùng công ty đạt gần 0% ở chỉ số này.
Không phải tiến bộ một chút, mà là từ 0% lên 83%.
Cụ thể nó làm được gì? Mythos đã viết một chương trình khai thác trình duyệt, kết nối bốn lỗ hổng riêng rẽ, sử dụng kỹ thuật JIT heap spray phức tạp, thoát thành công khỏi sandbox của tiến trình render và hệ điều hành. Nó cũng viết chương trình thực thi mã từ xa khai thác lỗ hổng máy chủ NFS của FreeBSD, sử dụng kỹ thuật ROP chain.
Chính Anthropic cho biết: mô hình này đã tìm thấy hàng nghìn lỗ hổng zero-day mới trong mọi hệ điều hành chính, mọi trình duyệt chính.
Bài báo trước về việc Mythos tìm ra lỗ hổng 27 năm tuổi, giờ đây chỉ là phần nổi của tảng băng chìm.
Chủ tịch Fed + Bộ trưởng Tài chính + CEO sáu ngân hàng lớn, trong cùng một phòng
Khi Anthropic phát hành bản xem trước Mythos vào ngày 7 tháng 4, họ giới hạn quyền truy cập trong khoảng 40 tổ chức — đây là dự án "Project Glasswing". Các bên được sử dụng bao gồm: Amazon, Apple, Microsoft, Google, Cisco, CrowdStrike, JPMorgan Chase, NVIDIA, Broadcom, Palo Alto Networks và Linux Foundation. Mỗi tổ chức tham gia còn nhận được tới 100 triệu USD tài nguyên tính toán.
Sau đó, vào ngày 10 tháng 4, Chủ tịch Cục Dự trữ Liên bang Jerome Powell và Bộ trưởng Tài chính Scott Bessent đã triệu tập các CEO của Goldman Sachs, Wells Fargo, Morgan Stanley, Bank of America và Citigroup vào cùng một phòng để tổ chức một cuộc họp khẩn cấp.
Chủ đề là: Điều gì xảy ra nếu AI của Anthropic rơi vào tay kẻ xấu?
CTO của CrowdStrike nói thẳng: "Khoảng thời gian từ khi phát hiện lỗ hổng đến khi bị kẻ tấn công khai thác đã giảm từ vài tháng xuống còn vài phút."
Nhưng Lầu Năm Góc vẫn cấm sử dụng Anthropic
Đây là điểm mâu thuẫn nhất.
Ngay khi Powell và Bessent triệu tập các chủ ngân hàng ở Washington để đánh giá Mythos, Lầu Năm Góc vẫn liệt Anthropic vào danh sách đen chuỗi cung ứng, yêu cầu các cơ quan quốc phòng ngừng sử dụng mọi nền tảng của Anthropic.
Lý do từ Tổng thống Trump và Bộ trưởng Quốc phòng Pete Hegseth: Anthropic kiên quyết hạn chế việc sử dụng AI của mình trong các tình huống quân sự.
Kết luận là: Nhà Trắng một mặt để Phố Wall thử nghiệm khả năng phòng thủ, mặt khác cấm quân đội sử dụng nó. Cùng một công ty, cùng một mô hình, cùng một chính quyền, nhưng hai thái độ hoàn toàn trái ngược.
Cựu cố vấn AI của Nhà Trắng David Sacks cho biết ông nghi ngờ liệu Anthropic có đang dùng nỗi lo an ninh để tiếp thị sản phẩm và gây ảnh hưởng đến chính sách quản lý hay không. Lời chỉ trích này có phần đúng.
Giải thích của Anthropic
Logic của Anthropic là: chính vì mô hình này quá nguy hiểm, họ mới không dám tùy tiện mở rộng quyền truy cập. Thiết kế của Project Glasswing là để các công ty công nghệ hàng đầu dùng Mythos tìm lỗ hổng trong hệ thống của chính họ, sửa chữa trước khi kẻ tấn công kịp hành động.
- Mythos tìm lỗ hổng → tổ chức tham gia sửa chữa → bên phòng thủ chiếm thế chủ động
- Các bên tham gia chia sẻ thông tin tình báo an ninh
- Anthropic báo cáo tất cả lỗ hổng tìm được cho các nhà sản xuất liên quan
Đây được gọi là "dùng AI chống AI". Vấn đề là: không phải ai cũng tin rằng Anthropic có thể kiểm soát ranh giới truy cập. Trong số 40 tổ chức tham gia có các đối thủ cạnh tranh thương mại, việc chia sẻ thông tin lỗ hổng tự nó là một trò chơi phức tạp.
Và con số "hàng nghìn" cho đến nay vẫn chưa được phân tích chi tiết.
Điều này có nghĩa là gì
Câu chuyện về Mythos quan trọng hơn bất kỳ điểm số benchmark nào, bởi vì nó chạm vào một dây thần kinh thực sự: nếu AI có thể tự động tìm lỗ hổng trong bất kỳ hệ thống nào, thì logic nền tảng của an ninh mạng cần phải được viết lại.
Powell và Bessent triệu tập các CEO ngân hàng đến họp khẩn, không phải để thảo luận về tiềm năng của AI. Mà bởi vì họ cho rằng mối đe dọa là có thật và đang đến gần.
Và chính cuộc họp khẩn cấp này là bằng chứng mạnh mẽ nhất cho sức mạnh của AI này.
Dù lời chỉ trích của Sacks có đúng hay không, một mô hình AI buộc Chủ tịch Fed phải ngồi cùng các CEO ngân hàng lớn ở Phố Wall để nghe một báo cáo an ninh — điều này lần đầu tiên xảy ra trong lịch sử loài người.
Nguồn tham khảo: Trump officials may be encouraging banks to test Anthropic's Mythos model (TechCrunch); Anthropic Mythos model can find and exploit 0-days (The Register); Powell, Bessent Warn Banks About Security Risks From Anthropic's Mythos AI (Bloomberg/Yahoo Finance); CocoLoop; After Anthropic's Mythos AI uncovers thousands of zero-day bugs, top US officials huddle with bank CEOs (TechXplore); Anthropic withholds Mythos Preview model because its hacking is too powerful (Axios)