OpenAI 于 UTC 19:00、8 月 19 日 发布一篇文章,重申其对前沿模型零数据保留的承诺,并预告一项名为 Private Safety Processing 的方案。外界将标题解读为一次发布,但这篇文章的两部分都没有描述一个已经上线的产品。
常见说法的错误之处
第一个错误是把 Zero Data Retention 当成新闻。ZDR 自 2023 年 起就已向符合条件的 API 客户开放:在符合条件的调用中,提示词和补全内容不会被存储,也不会用于训练。8 月 19 日并没有改变这一安排。第二个错误是把 Private Safety Processing 报道成一项已上线的隐私功能。它目前仍处于 预览 阶段,正与包括 Microsoft 和 Databricks 在内的早期客户测试,全面推出和技术白皮书都写明将在 2026 年 9 月 发布。
这一机制要解决的问题
逐条检查单个提示词与回复的安全系统,往往会错过只有在形成模式后才会显现的风险。OpenAI 产品政策主管 Aleah Houze 这样表示:风险会“不是只通过查看单个提示词和回复对来发现,而是在长时间观察多次交互时浮现出来”。Private Safety Processing 旨在让安全系统在相关交互之间进行观察,同时只输出有限信号,从而让任何 OpenAI 员工都看不到底层客户内容。
最关键的词是“eligible”
这项公告全文都在提到符合条件的 API 客户,但并未说明谁算符合条件。零数据保留究竟适用于所有付费套餐、仅限企业协议,还是需要特定合同安排,文中都没有说清楚。对采购团队来说,这就是全部问题——一项可能适用于也可能不适用于你合同的数据驻留保证,严格来说还算不上保证。
为何这种张力真实存在
前沿模型的安全监测与企业数据驻留承诺本就相互拉扯:监测希望看得更多,数据驻留则要求供应商少看一些。多数厂商会二选一。OpenAI 的立场是两者可以同时实现——至少在纸面上如此,而证明要等到一份尚不存在的白皮书。
