Ngày 7 tháng 4, cùng ngày Claude Mythos được công bố ra công chúng, một tổ chức Discord không rõ danh tính đã xâm nhập vào hệ thống của nó.
Sự việc chỉ bị Anthropic phát hiện vào ngày 21 tháng 4 — họ mất tới hai tuần mới nhận ra rằng mô hình AI bị kiểm soát chặt chẽ nhất thế giới đã bị một nhóm người lạ sử dụng miễn phí.
Nhóm này đã xâm nhập bằng cách nào
Con đường xâm nhập có thể được tóm tắt như sau:
- Một công ty khởi nghiệp đào tạo AI tên Mercor bị rò rỉ dữ liệu, dẫn đến việc thông tin xác thực nội bộ bị phát tán.
- Một nhóm Discord liên tục theo dõi GitHub, chuyên tìm kiếm thông tin về các mô hình AI chưa được công bố.
- Các thành viên trong nhóm kết hợp dữ liệu bị rò rỉ từ Mercor với thông tin đăng nhập của "một nhân viên nhà cung cấp bên thứ ba của Anthropic".
- Sử dụng các công cụ trinh sát mạng — loại thường được dùng trong giới nghiên cứu bảo mật — để xác định vị trí và truy cập vào môi trường xem trước của Mythos.
Bloomberg đã liên lạc với một thành viên của tổ chức này, người này cho biết họ "chỉ quan tâm đến mô hình mới, không có ý định gây rắc rối".
Tin hay không tùy bạn.
Anthropic nói gì
Tuyên bố chính thức của công ty như sau:
Chúng tôi đang điều tra một báo cáo về việc truy cập trái phép vào phiên bản xem trước của Claude Mythos, với điểm xâm nhập đến từ môi trường của một nhà cung cấp bên thứ ba.
Đây là giọng điệu tiêu chuẩn của một cuộc khủng hoảng truyền thông doanh nghiệp. Không đề cập đến quy mô xâm nhập, không nói nhóm này đã thấy gì, cũng không cho biết liệu có dữ liệu nào bị lấy đi hay không.
Tại sao vấn đề này nghiêm trọng hơn vẻ ngoài
Mythos không phải là một mô hình chưa phát hành thông thường.
Ngay từ khi công bố, Anthropic đã nói rõ rằng mô hình này chỉ được cung cấp cho 40 công ty đã được thẩm định, vì hiệu suất của nó trong khả năng tấn công mạng đã chạm đến ngưỡng an toàn nội bộ. Nói cách khác, chính Anthropic cũng cho rằng nó không thể được phát hành rộng rãi.
Một AI "quá nguy hiểm để phát hành công khai" đã bị một nhóm người không rõ danh tính truy cập trong 15 ngày — điều này hoàn toàn khác với việc "ai đó đã dùng thử một chatbot nội bộ".
Quan trọng hơn: họ đã xâm nhập vào ngày 7 tháng 4, đúng ngày Mythos được công bố lần đầu. Khoảng cách giữa thông báo và vụ xâm nhập có thể chỉ là vài giờ.
Chuỗi cung ứng bên thứ ba: Lỗ hổng khó vá nhất của các công ty AI
Hệ thống bảo mật của Anthropic có thể rất tốt. Nhưng điểm xâm nhập lần này không nằm bên trong Anthropic, mà ở một nhân viên của nhà thầu phụ.
Các công ty AI trong giai đoạn mở rộng nhanh chóng buộc phải sử dụng nhiều nhà cung cấp bên ngoài — gắn nhãn dữ liệu, xây dựng hạ tầng, thử nghiệm, kiểm tra tuân thủ. Mỗi điểm kết nối đều là một lỗ hổng tiềm ẩn.
Con đường lần này là: Rò rỉ Mercor → Tài khoản nhân viên nhà cung cấp → Môi trường xem trước nội bộ của Anthropic. Mỗi bước đều là "vấn đề của người khác", nhưng cuối cùng lại trở thành vấn đề của chính Anthropic.
OpenAI, Google, Meta đều từng gặp các sự cố bảo mật chuỗi cung ứng tương tự, chỉ khác nhau ở chỗ vụ nào lên báo.
Nhóm này đã làm gì?
Hiện tại vẫn chưa rõ. Bloomberg không tiết lộ, và Anthropic cũng không nói.
Họ có thể chỉ kiểm tra ranh giới của mô hình, chạy một số benchmark, hoặc cũng có thể đã trích xuất thứ gì đó mang đi. Tuyên bố "chúng tôi không có ý định gây rắc rối" không thể được xác minh bằng bất kỳ cách nào.
Tình thế của Anthropic hiện tại là: trước khi cuộc điều tra kết thúc, chính họ cũng không hoàn toàn biết chuyện gì đã xảy ra trong môi trường xem trước đó.
Nguồn tham khảo: Some Unknown Group Is Reportedly Using Claude Mythos Without Permission (Gizmodo); CocoLoop, Unauthorized Group Gains Access to Anthropic's Exclusive Cyber Tool Mythos (Cybersecurity News)