Điểm CTF của GPT-5.4-Cyber tăng từ 27% lên 76%

Tuần trước, Anthropic ra mắt Mythos, tuyên bố chỉ cung cấp cho 40 tổ chức, giúp một số nhóm phát hiện ra lỗ hổng 27 năm tuổi. Tuần này, OpenAI đáp trả trực tiếp: GPT-5.4-Cyber ra mắt, nhắm đến hàng nghìn nhà nghiên cứu bảo mật và hàng trăm nhóm, quy mô vượt trội so với hướng tiếp câu lạc bộ tinh hoa của Mythos.

Hai công ty, trong cùng một khung thời gian, sử dụng hai chiến lược hoàn toàn khác nhau để cạnh tranh trên cùng một đường đua.

GPT-5.4-Cyber là gì?

Đây không phải là một mô hình hoàn toàn mới, mà là biến thể chuyên dụng cho an ninh mạng của GPT-5.4. Sự khác biệt cốt lõi nằm ở việc nới lỏng có chủ đích các hạn chế đối với các tình huống bảo mật phòng thủ.

Khả năng mới quan trọng nhất: dịch ngược nhị phân (binary reverse engineering).

Phân tích bảo mật thông thường thường yêu cầu có mã nguồn hoặc phải tháo gỡ thủ công. GPT-5.4-Cyber có thể trực tiếp nhận các tệp nhị phân đã biên dịch, giúp bạn tìm lỗ hổng và xác định logic độc hại. Trong thực tế, chỉ có một số ít phần mềm độc hại có sẵn mã nguồn — phần lớn các phân tích APT, dịch ngược ransomware và kiểm tra chuỗi cung ứng an ninh đều phải đối phó với các hộp đen đã biên dịch. Tính năng này giải quyết trực tiếp những tình huống khó khăn nhất của các kỹ sư bảo mật.

Từ 27% lên 76%: Những con số này nói lên điều gì?

OpenAI sử dụng chuẩn CTF (Capture The Flag) để đo lường sự tiến bộ về khả năng bảo mật:

Thời gianMô hìnhĐiểm chuẩn CTF
Tháng 8/2025GPT-527%
Tháng 11/2025GPT-5.1-Codex-Max76%

Từ 27% lên 76% trong ba tháng — đồng nghĩa với việc khả năng giải quyết vấn đề thực tế của AI trong lĩnh vực an ninh mạng đã tăng gần gấp ba lần. Một năm trước, AI chỉ có thể trả lời các câu hỏi bảo mật cơ bản; giờ đây, nó có thể giải quyết hầu hết các bài toán CTF ở mức độ trung bình.

Đồng thời, công cụ phân tích bảo mật mã nguồn Codex Security dựa trên GPT-5.4-Cyber, kể từ khi thử nghiệm nội bộ, đã giúp khắc phục hơn 3.000 lỗ hổng mức cao hoặc nghiêm trọng.

Chương trình TAC: Truy cập phân cấp, không phải ai cũng dùng được

Kênh truy cập GPT-5.4-Cyber là chương trình Trusted Access for Cyber (TAC), ra mắt vào tháng 2 cùng với khoản tài trợ an ninh mạng trị giá 10 triệu USD, khi đó chạy trên GPT-5.3-Codex.

Lần nâng cấp này giới thiệu hệ thống xác thực danh tính đa tầng:

  • Tầng cơ bản: Xác minh tiêu chuẩn, có thể sử dụng các tính năng an ninh mạng thông thường
  • Tầng nâng cao: Xác minh danh tính chặt chẽ hơn, mở khóa các khả năng mạnh hơn
  • Tầng cao nhất: Mức xác minh cao nhất, mới có thể truy cập GPT-5.4-Cyber

Cổng đăng ký cá nhân tại chatgpt.com/cyber, nhóm doanh nghiệp đi qua kênh bán hàng của OpenAI. Các thành viên TAC hiện tại có thể đăng ký riêng để nâng cấp lên cấp độ cao hơn.

Anthropic vs OpenAI: Sự đụng độ trực diện giữa hai hướng đi

Thời điểm này quá trùng hợp, không thể là ngẫu nhiên.

Tuần trước, Anthropic ra mắt Mythos, nhấn mạnh vào tinh hoa, số lượng đối tác nhỏ, dùng kết quả để chứng minh. Phản ứng của OpenAI là triển khai trên quy mô lớn, với hàng nghìn người tham gia, dùng phạm vi bao phủ để giành lợi thế.

Anthropic MythosOpenAI GPT-5.4-Cyber
Thời gian ra mắtTuần đầu tháng 4/2026Ngày 14 tháng 4 năm 2026
Quy mô người dùng mục tiêu~40 tổ chứcHàng nghìn cá nhân + hàng trăm nhóm
Chiến lược cốt lõiTinh hoa, chứng minh bằng kết quảTriển khai rộng rãi, tạo giá trị phòng thủ thực tế
Khả năng tiêu biểuPhát hiện lỗ hổng 27 năm tuổiDịch ngược nhị phân, điểm chuẩn CTF 76%

Cách nào hiệu quả hơn? Hiện tại chưa thể kết luận. Nhưng việc cả hai công ty cùng tranh giành đường đua AI an ninh mạng trong cùng một khung thời gian đã cho thấy hướng đi này được coi là một chiến trường chiến lược thực sự.

Một ranh giới đáng chú ý khác

Sự nới lỏng của GPT-5.4-Cyber có giới hạn, chỉ áp dụng cho các tình huống bảo mật phòng thủ. OpenAI yêu cầu kiểm soát triển khai chặt chẽ hơn, phải ký thỏa thuận trước khi sử dụng.

Phân tích logic C2 của phần mềm độc hại: được phép. Dùng để viết công cụ tấn công mới: chắc chắn không được.

Các ranh giới cụ thể sẽ được thực thi như thế nào, vẫn cần chờ phản hồi từ cộng đồng trong quá trình sử dụng thực tế.

Nguồn tham khảo: OpenAI launches GPT-5.4-Cyber model for vetted security professionals (SiliconANGLE); CocoLoop, OpenAI Releases Cyber Model to Limited Group in Race With Mythos (Bloomberg)