OpenAI承诺零留存,安全检测不看原文

8 月 19 日,OpenAI 在官网挂出一则面向 API 客户的公告:对符合条件的客户继续提供零数据留存(Zero Data Retention,ZDR),请求处理完毕后不保留提示词与模型回复。同一则公告里,它预览了一套叫”私密安全处理”的机制——在不向 OpenAI 员工暴露原始内容的前提下,跨多次相关交互识别滥用迹象。

零数据留存不是新词。金融、医疗、法务这类客户签合同时,能不能做到”你们那边什么都不存”,一直是过不去就没有下文的一条。公开报道显示,这次单独发公告,起因是模型开始接更长、更自动的活:一次请求看不出问题,风险散在一串会话里。滥用检测想抓这种模式,就得留下点东西可比对——和零留存正好顶上。

把检测搬进加密的盒子

OpenAI 给的解法是把可比对的部分交给客户自己保管。客户内容可以留在客户控制的基础设施上,也可以由 OpenAI 存储,但加密密钥握在客户手里。自动化系统在这层加密内容上做跨会话评估,看的是多个对话的输入和输出,不再盯孤立的单条请求。一旦命中,回传给 OpenAI 的只是一个信号:

a narrowly defined safety signal, without exposing the underlying prompts or responses

一个界定得很窄的安全信号,不暴露背后的提示词与回复。

拿到信号之后要不要进一步排查,由客户决定是否交出数据。按公司说法,这套机制既盯滥用平台的人,也盯跑偏的 AI Agent。

有一个例外写得很直白:被标记为疑似儿童性虐材料的图片,即便在零留存部署下也照旧保留,供人工复核与上报,和现在的做法一致。

和 Anthropic 分了岔

同一个问题,另一家公司给的答案几乎相反。多家媒体报道称,Anthropic 对部分覆盖模型会保留 30 天的会话数据,人工复核走受控访问路径,谁看过什么记进防篡改日志。它押的是可追溯:出了事有完整证据链,谁碰过数据一查便知。

OpenAI 押的是不产生证据链。**两条路的分歧点不在安全能力,在企业客户怕的是什么。**怕内部滥用和事后甩锅的公司,会喜欢防篡改日志;怕外部传票和跨境合规的公司,更愿意让数据压根不落在供应商手里——30 天的保留窗口,粗算下来就是每份对话有一个月时间处在可被外部程序触达的状态。对一家在多个司法辖区做生意的企业来说,这一个月不好向法务解释。

出海团队采购模型时,这条可以直接写进问题清单:数据存在哪、密钥归谁、命中安全策略之后走什么流程。以前这类问题往往只能拿到一句”我们很重视安全”。

白皮书之前都算预告

私密安全处理目前只在早期客户里测试,计划 9 月逐步开放,同期发布技术白皮书。公告没有说清的部分还不少:覆盖哪些模型、信号的粒度到底多细、误报了客户要走什么申诉流程。加密存储上做跨会话分析,工程实现方式也没有披露——这类描述在拿到白皮书之前,还只是承诺,不是可验证的设计。

对企业采购方来说,眼下能做的是把九月这个节点记下来。白皮书出来之后,把它和自己的合规清单逐条对,比现在读公告有用得多。

参考来源:OpenAI 官方公告、CocoLoop、TechCrunch;以 OpenAI 公告核验零留存适用客户范围、加密密钥归属与私密安全处理的开放安排。