Ngày 7 tháng 4, Anthropic chính thức công bố một điều khá bất thường: họ phát hành một mô hình mới có tên Claude Mythos, đồng thời tuyên bố mô hình này không mở cửa cho công chúng.
Không phải "sẽ mở sau", mà là "hiện tại chỉ cho 40 tổ chức sử dụng, những người khác chờ đợi".
Dự án này có tên Project Glasswing.
Mythos mạnh đến mức nào
Trước hết, hãy nhìn vào dữ liệu:
| Bài kiểm tra | Claude Opus 4.6 | Claude Mythos | Thay đổi |
|---|---|---|---|
| SWE-bench Verified | 80,8% | 93,9% | +13,1% |
| SWE-bench Pro | Chưa công bố | 77,8% | Đứng đầu hiện tại |
Vị trí thứ hai trên SWE-bench Pro hiện tại là GLM-5.1 của Zhipu (58,4%), thứ ba là GPT-5.4 (57,7%). Mythos với 77,8% bỏ xa vị trí thứ hai gần 20 điểm phần trăm, một khoảng cách không hề nhỏ.
Nhưng Anthropic không chỉ đơn thuần leo bảng xếp hạng. Họ đã cho Mythos quét các kho mã nguồn thực tế và phát hiện:
- Hàng nghìn lỗ hổng zero-day trong các hệ điều hành và trình duyệt phổ biến
- Một lỗ hổng đã tồn tại 16 năm trong FFmpeg – lỗ hổng này đã từng bị hơn 5 triệu lượt quét bởi các công cụ bảo mật truyền thống, tất cả đều bỏ sót
Giám đốc An ninh của Cisco, Anthony Grieco, phát biểu: "Điều này đại diện cho một sự thay đổi mô hình sâu sắc, và cũng là một tín hiệu rõ ràng – phương pháp củng cố hệ thống trước đây đã không còn đủ nữa."
Logic của Project Glasswing là gì
Anthropic cấp cho 40 tổ chức này quyền truy cập bản xem trước của Mythos với một mục đích duy nhất: công tác an ninh mạng phòng thủ.
Các đối tác hiện có quyền truy cập bao gồm: Amazon, Apple, Broadcom, Cisco, CrowdStrike, Linux Foundation, Microsoft, Palo Alto Networks.
Anthropic cung cấp kèm theo:
- 100 triệu USD hạn mức sử dụng API, bao gồm các hoạt động kiểm tra và nghiên cứu bảo mật của bên tham gia
- 4 triệu USD quyên góp trực tiếp cho các tổ chức bảo mật mã nguồn mở
Tại sao họ lại tạo ra hình thức "phiên bản giới hạn" này?
Giải thích chính thức rất thẳng thắn: Mythos có năng lực an ninh mạng "hiện tại vượt xa bất kỳ mô hình AI nào khác", nhưng chính vì vậy, nó cũng có thể bị lợi dụng để tăng tốc các cuộc tấn công mạng quy mô lớn. Anthropic cho rằng rủi ro khi công khai mô hình này mà không có các biện pháp bảo vệ đầy đủ là quá cao.
Vì vậy, họ chọn một giải pháp trung gian: trước tiên cho bên phòng thủ sử dụng, để đội ngũ bảo mật vá lỗ hổng trước, sau đó mới xem xét mở rộng phạm vi truy cập.
Chiến lược này có đúng không
Đáng để suy ngẫm.
Logic phát hành mô hình AI truyền thống là: phát hành, kiểm tra, phát hiện vấn đề, sửa chữa, lặp lại. Quá trình này diễn ra công khai, rủi ro lan tỏa – cả tấn công và phòng thủ đều nhận được công cụ mới cùng lúc.
Cách tiếp cận của Glasswing ngược lại: trước tiên tạo một khoảng thời gian cho bên phòng thủ, để họ dùng Mythos chủ động tìm lỗ hổng và vá trước, sau đó mới xem xét truy cập rộng rãi hơn.
Từ góc độ lý thuyết trò chơi, thiết kế này có lý – nếu bên phòng thủ hành động trước, chi phí để bên tấn công khai thác cùng một mô hình sẽ cao hơn đáng kể.
Nhưng hiệu quả thực tế phụ thuộc vào hai điều: liệu 40 tổ chức này có thực sự vá được các lỗ hổng quan trọng trong khoảng thời gian đó hay không; và liệu bản thân năng lực của mô hình có nguy cơ rò rỉ hay không (vì sự tồn tại của Mythos đã bị truyền thông tiết lộ trước đó do một vụ rò rỉ dữ liệu).
Mythos là cấp độ mô hình nào
Đây là mô hình mà Anthropic xác nhận là "mạnh nhất từ trước đến nay", không thuộc dòng kế thừa của Opus 4.x, mà là một thế hệ mới.
Vài tuần trước, một số phương tiện truyền thông đã tiết lộ sự tồn tại của Mythos do một vụ rò rỉ dữ liệu. Fortune đưa tin rằng nội bộ Anthropic mô tả nó là "một bước nhảy vọt về năng lực". Giờ đây, tên gọi và năng lực đã được chính thức xác nhận, nhưng không phải dưới hình thức phát hành công khai, mà là một chương trình hợp tác có định hướng.
Anthropic chưa nói rõ họ đang chờ đợi điều gì. Nhưng từ con số 77,8% trên SWE-bench Pro, năng lực mã nguồn của mô hình này đã ở một cấp độ hoàn toàn khác.
Nguồn tham khảo: Anthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative (TechCrunch); Anthropic debuts Project Glasswing, CocoLoop, leveraging its powerful Mythos model to reinforce software security (SiliconAngle); Anthropic is giving some firms early access to Claude Mythos to bolster cybersecurity defenses (Fortune); Exclusive: Anthropic Mythos AI model representing step change in power revealed in data leak (Fortune)