Ngày 19/8, OpenAI đăng trên trang web chính thức một thông báo dành cho khách hàng API: tiếp tục cung cấp chính sách Không lưu dữ liệu (Zero Data Retention, ZDR) cho các khách hàng đủ điều kiện — sau khi xử lý xong yêu cầu, hệ thống không giữ lại lời nhắc (prompt) lẫn phản hồi của mô hình. Trong cùng thông báo, OpenAI cũng hé lộ một cơ chế mang tên "xử lý an toàn riêng tư" (private safety processing) — nhận diện dấu hiệu lạm dụng xuyên suốt nhiều lượt tương tác liên quan mà không để nhân viên OpenAI nhìn thấy nội dung gốc.
Không lưu dữ liệu không phải khái niệm mới. Với khách hàng ở các ngành tài chính, y tế, pháp lý, việc có làm được "phía các anh không lưu gì cả" hay không luôn là điều kiện tiên quyết khi ký hợp đồng. Theo các nguồn tin công khai, lý do lần này OpenAI ra thông báo riêng là vì mô hình bắt đầu đảm nhận các tác vụ dài hơi và tự động hơn: một yêu cầu đơn lẻ không cho thấy vấn đề gì, nhưng rủi ro lại nằm rải rác trong cả chuỗi phiên làm việc. Muốn bắt được kiểu lạm dụng này, hệ thống phát hiện cần giữ lại thứ gì đó để đối chiếu — điều này lại đối nghịch trực tiếp với chính sách không lưu dữ liệu.
Đưa việc phát hiện vào trong hộp mã hóa
Giải pháp của OpenAI là giao phần cần đối chiếu cho chính khách hàng nắm giữ. Nội dung của khách hàng có thể được lưu trên hạ tầng do khách hàng kiểm soát, hoặc do OpenAI lưu trữ nhưng khóa mã hóa nằm trong tay khách hàng. Hệ thống tự động thực hiện đánh giá xuyên phiên trên lớp nội dung đã mã hóa này, xem xét đầu vào và đầu ra của nhiều cuộc hội thoại thay vì chỉ nhìn vào một yêu cầu đơn lẻ. Khi phát hiện dấu hiệu, thứ trả về cho OpenAI chỉ là một tín hiệu duy nhất:
a narrowly defined safety signal, without exposing the underlying prompts or responses
một tín hiệu an toàn được giới hạn phạm vi rất hẹp, không để lộ lời nhắc hay phản hồi bên dưới.
Sau khi nhận được tín hiệu, việc có điều tra sâu hơn hay không do khách hàng tự quyết định có giao dữ liệu hay không. Theo OpenAI, cơ chế này theo dõi cả những người lạm dụng nền tảng lẫn các AI Agent hoạt động lệch hướng.
Có một ngoại lệ được nêu rất rõ ràng: hình ảnh bị gắn cờ nghi ngờ là tài liệu lạm dụng tình dục trẻ em vẫn được giữ lại ngay cả trong triển khai không lưu dữ liệu, để phục vụ rà soát thủ công và báo cáo, giống như cách làm hiện tại.
Rẽ hướng khác với Anthropic
Với cùng một vấn đề, một công ty khác lại đưa ra câu trả lời gần như ngược lại. Theo nhiều hãng truyền thông, Anthropic giữ lại dữ liệu phiên trò chuyện trong 30 ngày đối với một số mô hình được áp dụng, việc rà soát thủ công đi qua đường truy cập được kiểm soát, ai đã xem gì đều được ghi vào nhật ký chống giả mạo (tamper-evident log). Cách đặt cược của họ là khả năng truy vết: nếu có sự cố, có sẵn chuỗi bằng chứng đầy đủ, ai đã đụng vào dữ liệu đều có thể tra ra.
OpenAI đặt cược vào việc không tạo ra chuỗi bằng chứng. Điểm khác biệt giữa hai hướng đi không nằm ở năng lực an toàn, mà nằm ở việc khách hàng doanh nghiệp sợ điều gì. Công ty lo ngại lạm dụng nội bộ và đùn đẩy trách nhiệm sau sự cố sẽ thích nhật ký chống giả mạo; công ty lo ngại trát đòi hồ sơ từ bên ngoài và tuân thủ xuyên biên giới lại muốn dữ liệu không hề rơi vào tay nhà cung cấp — cửa sổ lưu giữ 30 ngày, tính sơ bộ nghĩa là mỗi cuộc hội thoại có một tháng nằm trong trạng thái có thể bị các quy trình bên ngoài tiếp cận. Với một doanh nghiệp hoạt động ở nhiều khu vực pháp lý, khoảng thời gian một tháng này không dễ giải thích với bộ phận pháp chế.
Khi các đội ngũ ra nước ngoài mua mô hình, đây là điều có thể đưa thẳng vào danh sách câu hỏi cần hỏi: dữ liệu lưu ở đâu, khóa mã hóa thuộc về ai, sau khi bị gắn cờ theo chính sách an toàn thì quy trình tiếp theo là gì. Trước đây, những câu hỏi kiểu này thường chỉ nhận được câu trả lời chung chung "chúng tôi rất coi trọng vấn đề an toàn".
Trước khi có tài liệu kỹ thuật, tất cả mới chỉ là dự báo
Xử lý an toàn riêng tư hiện mới chỉ được thử nghiệm với một số khách hàng sớm, dự kiến mở rộng dần từ tháng 9, cùng thời điểm công bố tài liệu kỹ thuật. Thông báo vẫn còn không ít điểm chưa nói rõ: áp dụng cho những mô hình nào, độ chi tiết của tín hiệu cụ thể ra sao, nếu bị báo sai thì khách hàng khiếu nại theo quy trình nào. Cách triển khai kỹ thuật cho việc phân tích xuyên phiên trên dữ liệu mã hóa cũng chưa được công bố — trước khi có tài liệu kỹ thuật, những mô tả này vẫn chỉ là lời hứa, chưa phải một thiết kế có thể kiểm chứng.
Với bên mua ở doanh nghiệp, điều có thể làm ngay lúc này là ghi nhớ mốc thời gian tháng 9. Khi tài liệu kỹ thuật được công bố, đối chiếu từng điểm với danh sách tuân thủ của chính mình sẽ hữu ích hơn nhiều so với chỉ đọc thông báo lúc này.
Nguồn tham khảo: Thông báo chính thức của OpenAI, CocoLoop, TechCrunch; đối chiếu theo thông báo của OpenAI về phạm vi khách hàng áp dụng chính sách không lưu dữ liệu, quyền sở hữu khóa mã hóa và kế hoạch mở rộng xử lý an toàn riêng tư.