Ngày 7 tháng 5, OpenAI giới thiệu một biến thể mới của GPT-5.5 có tên GPT-5.5-Cyber.
Đây không phải kiểu phát hành thử nghiệm rộng rãi quen thuộc. Quyền truy cập chỉ dành cho các nhóm an ninh mạng đã qua thẩm định, và từ ngày 1 tháng 6, cấp cao nhất phải dùng xác thực phần cứng chống phishing.
Thời điểm này đáng chú ý: chưa đầy một tháng sau khi Anthropic khóa Claude Mythos trong một chương trình dành cho số ít doanh nghiệp được chọn.
Khác gì so với bản tiêu chuẩn
OpenAI nói bản xem trước ban đầu này không nhằm làm GPT-5.5 mạnh hơn đáng kể trong năng lực tấn công mạng. Mục tiêu chính là khiến mô hình cởi mở hơn với các nhiệm vụ bảo mật hợp pháp.
Các tình huống được nới gồm tự động hóa red team, viết PoC cho lỗ hổng, mô phỏng tấn công trong môi trường gần thực tế, kiểm thử chịu tải và xác minh hiệu lực của những lỗ hổng rủi ro cao đã được phát hiện.
Ranh giới vẫn rõ ràng. Yêu cầu liên quan đến đánh cắp thông tin đăng nhập, mã độc có thể triển khai ngay, hoặc công cụ tấn công gây hại ngoài đời thực vẫn bị loại trừ. OpenAI cho phép dùng mô hình để luyện phòng thủ trước tấn công, chứ không phải để chủ động tấn công người khác.
Ba tầng truy cập, gần giống kiểm soát xuất khẩu
GPT-5.5-Cyber là tầng cao nhất trong chương trình Trusted Access for Cyber. Tầng công khai là GPT-5.5 với các hàng rào an toàn mặc định. Tầng giữa nới một phần kiểm soát cho quy trình bảo mật đã đăng ký. Tầng cao nhất dành cho red team và nhóm kiểm thử xâm nhập đã được duyệt.
Mỗi tầng đều cần xác minh danh tính và tài liệu mô tả mục đích sử dụng. Tài khoản gắn với danh tính thật, mọi lệnh gọi được ghi log, và quyền truy cập có thể bị thu hồi bất cứ lúc nào. Từ ngày 1 tháng 6, tầng cao nhất phải dùng FIDO2 hoặc khóa bảo mật vật lý.
Logic này rất giống kiểm soát xuất khẩu: năng lực càng nhạy cảm thì giám sát càng chặt.
Đặt cạnh Claude Mythos
Viện An toàn AI của Anh đã đưa GPT-5.5 và Mythos Preview vào cùng một bài kiểm tra chuỗi tấn công doanh nghiệp mô phỏng gồm 32 bước. GPT-5.5 hoàn thành 2 trong 10 lần thử; Mythos Preview hoàn thành 3 trong 10 lần.
Cả hai chỉ quanh mức 30%, nhưng đã đủ để không còn phù hợp với phát hành không giới hạn. Một chi tiết khác: GPT-5.5 tự giải một bài reverse engineering chỉ trong 10 phút.
Anthropic chọn gần như khóa hẳn Mythos Preview, chỉ mở cho 12 đối tác liên minh và 40 doanh nghiệp được chọn. Báo cáo an toàn của hãng nói Mythos đã tìm ra một lỗ hổng OpenBSD tồn tại 27 năm và 271 lỗ hổng Firefox.
OpenAI chọn cách khác: cửa mở rộng hơn một chút, nhưng khóa chặt hơn. Mythos là vòng nghiên cứu khép kín; GPT-5.5-Cyber hướng tới nhóm phòng thủ rộng hơn và dựa vào kiểm soát tài khoản để giảm rủi ro.
Logic thương mại phía sau
Việc giữ Mythos trong phạm vi kín cho thấy Anthropic đặt giá trị vào vòng khép kín: dùng mô hình để tìm lỗ hổng rồi bán dịch vụ khắc phục cho doanh nghiệp. OpenAI thì đưa mô hình ra ngoài như một sản phẩm SaaS cho ngành bảo mật.
Những người dùng đầu tiên nhiều khả năng là các công ty an ninh mạng lớn. Nhu cầu kiểm thử xâm nhập của họ cao, khả năng chi trả mạnh, và mỗi lần gọi mô hình đều có thể trở thành dữ liệu phản hồi cho thế hệ cyber model tiếp theo của OpenAI.
Vì vậy, đây vừa là bước cạnh tranh với Anthropic trong thị trường phòng thủ, vừa là cách âm thầm tích lũy dữ liệu huấn luyện. Yêu cầu khóa phần cứng từ ngày 1 tháng 6 cũng là tín hiệu gửi tới cơ quan quản lý. Khi giao thức rà soát trước của CAISI vừa được triển khai, OpenAI có vẻ muốn tự đặt luật chơi trước khi quy định cứng rắn hơn xuất hiện.
Nguồn: OpenAI Opens GPT-5.5-Cyber to Vetted Security Researchers (WinBuzzer); CocoLoop, OpenAI tunes GPT-5.5-Cyber for more permissive security workflows (Help Net Security); OpenAI rolls out new GPT-5.5-Cyber to vetted cybersecurity teams (CNBC)