8 月 19 日,OpenAI 在官網貼出一則針對 API 客戶的公告:符合資格的客戶將持續享有零資料留存(Zero Data Retention,ZDR),也就是請求處理完畢後不保留提示詞與模型回覆。同一則公告中,OpenAI 也預告了一套名為「Private Safety Processing(私密安全處理)」的機制——在不讓 OpenAI 員工看到原始內容的前提下,跨越多次相關互動辨識濫用跡象。
零資料留存並不是新名詞。金融、醫療、法務這類客戶在簽約時,供應商能不能做到「你們那邊什麼都不存」,向來是談不攏就沒有下文的條款。根據公開報導,這次特別另發公告的原因,是模型開始承接更長、更自動化的工作:單一請求看不出問題,風險是分散在一連串對話裡的。濫用偵測想抓出這種模式,就得留下一些可比對的東西——這正好和零留存互相牴觸。
把偵測搬進加密的箱子裡
OpenAI 給出的解法,是把可比對的部分交還給客戶自己保管。客戶的內容可以留在客戶自行掌控的基礎設施上,也可以由 OpenAI 儲存,但加密金鑰握在客戶手中。自動化系統在這層加密內容上進行跨對話評估,看的是多組對話的輸入與輸出,不再只盯著單一、孤立的請求。一旦命中,回傳給 OpenAI 的只有一個信號:
a narrowly defined safety signal, without exposing the underlying prompts or responses
一個界定得很窄的安全信號,不會暴露背後的提示詞與回覆。
拿到信號之後要不要進一步查證,由客戶自行判斷是否交出資料。根據該公司的說法,這套機制同時盯著濫用平台的人,以及行為脫序的 AI 代理人(AI Agent)。
有一項例外寫得相當直白:被標記為疑似兒少性剝削素材的圖片,即便在零留存的部署下也照樣保留,供人工複核與通報使用,這一點和現行做法一致。
與 Anthropic 分道揚鑣
面對同一個問題,另一家公司給出的答案幾乎完全相反。多家媒體報導指出,Anthropic 針對部分涵蓋的模型會保留 30 天的對話資料,人工複核走的是受控存取路徑,誰查看過什麼都會記錄進防竄改日誌。它押注的是可追溯性:一旦出事,有完整的證據鏈可查,誰碰過資料一查便知。
OpenAI 押注的,則是根本不產生證據鏈。這兩條路線的分歧點不在安全能力,而在企業客戶究竟在怕什麼。擔心內部濫用與事後互相推諉的公司,會偏好防竄改日誌;擔心外部傳票與跨境法遵問題的公司,則更希望資料根本不落在供應商手上——30 天的保留期,粗略換算下來,等於每一段對話都有一個月的時間處於可被外部程序調閱的狀態。對一家在多個司法管轄區經營業務的企業來說,這一個月不太好向法務部門解釋。
出海團隊在採購模型時,可以把這一點直接寫進提問清單:資料存放在哪裡、金鑰歸誰持有、觸發安全政策之後又是什麼流程。過去這類問題往往只能得到一句「我們非常重視資安」。
白皮書出爐之前都只是預告
Private Safety Processing 目前僅在少數早期客戶中測試,計畫於 9 月逐步開放,並同步發布技術白皮書。公告裡沒說清楚的地方還不少:涵蓋哪些模型、信號的顆粒度到底多細、若誤判客戶要走什麼申訴流程。至於如何在加密儲存上做跨對話分析,工程實作方式也尚未公開——這類描述在白皮書出爐之前,都還只是承諾,稱不上是可驗證的設計。
對企業採購方而言,眼下能做的就是先把 9 月這個時間點記下來。等白皮書真的出來,把它和自家的法遵清單逐項對照,會比現在光讀公告有用得多。
參考來源:OpenAI 官方公告、CocoLoop、TechCrunch;零留存適用客戶範圍、加密金鑰歸屬與 Private Safety Processing 的開放安排,均以 OpenAI 官方公告核實。