GPT-5.3 Codex nhận xếp hạng bảo mật nguy hiểm đầu tiên từ OpenAI

Ngày 5 tháng 2 năm nay, OpenAI phát hành GPT-5.3-Codex, khả năng lập trình thực sự tăng vọt—nhưng đi kèm với đó là một nhãn không mấy dễ chịu: mức "Cao" đầu tiên về rủi ro an ninh mạng trong khuôn khổ đánh giá bảo mật nội bộ của OpenAI.

Nguy hiểm đến mức nào?

OpenAI tự nói một cách khéo léo: "Không có bằng chứng chắc chắn rằng mô hình này có thể tự động hóa hoàn toàn các cuộc tấn công mạng", nhưng "vì lý do phòng ngừa" đã triển khai "hệ thống bảo vệ an ninh mạng toàn diện nhất từ trước đến nay".

Nói thẳng ra là: Khả năng lập trình của mô hình này đã đạt đến một điểm tới hạn, nếu bị khai thác tự động hóa trên quy mô lớn, nó có thể gây ra tác hại thực sự trong lĩnh vực an ninh mạng.

Các biện pháp bảo mật

OpenAI đã áp dụng nhiều lớp bảo vệ:

  • Huấn luyện an toàn: Căn chỉnh ở cấp độ mô hình
  • Giám sát tự động: Phát hiện các yêu cầu đáng ngờ
  • Truy cập phân cấp: Các thao tác rủi ro cao chỉ dành cho người dùng đáng tin cậy
  • Định tuyến hạ cấp: Các yêu cầu phát hiện rủi ro an ninh mạng cao sẽ tự động được chuyển sang GPT-5.2 thế hệ trước xử lý

Lịch trình phát hành cũng thận trọng bất thường, trì hoãn việc mở rộng hoàn toàn cho các nhà phát triển.

Những tranh cãi sau đó

Cơ quan quản lý an ninh AI của California sau đó tuyên bố rằng việc phát hành này có thể vi phạm luật an toàn AI mới được thông qua của tiểu bang. OpenAI đã phủ nhận cáo buộc này.

Vào tháng 3, cũng có một lỗ hổng rò rỉ token GitHub của Codex bị phát hiện—sau đó đã được vá.

OpenAI cũng đã cung cấp 10 triệu đô la hạn mức API để hỗ trợ nghiên cứu phòng thủ mạng, tiếp nối chương trình tài trợ an ninh mạng trị giá 1 triệu đô la bắt đầu từ năm 2023.

Đằng sau tất cả là một mâu thuẫn sâu sắc: Khả năng lập trình càng mạnh, rủi ro bị lạm dụng càng cao. Sự cải thiện năng lực của mô hình và sự gia tăng rủi ro bảo mật gần như có tương quan tuyến tính. OpenAI đã chọn con đường "phát hành trước, bảo vệ sau" thay vì "bảo vệ xong mới phát hành". Về lựa chọn này, ngành công nghiệp có sự chia rẽ lớn.

Nguồn tham khảo: CocoLoop, báo cáo của Fortune