OpenAI推出Private Safety Processing,在不读取客户数据的前提下监控AI安全风险
要点速览
- •OpenAI于2026年8月19日宣布Private Safety Processing(PSP),针对API客户的分阶段推出自2026年9月22日开始。
- •PSP仅向OpenAI传输有限的安全信号,能够在零数据保留承诺下、交互内容保持不透明的前提下,检测诸如探测安全防护或智能体偏离目标等跨多轮交互的风险模式。
- •企业客户可选择将数据完全保留在自有基础设施中,或使用自行控制的加密密钥将其加密存储在OpenAI服务器上。
- •Anthropic自2026年6月起对某些前沿模型确立了30天的数据保留要求,与OpenAI的无保留处理方式形成对比。
- •PSP是专属于企业和API的产品,不适用于ChatGPT的消费者层级,包括Free、Plus、Go和Pro方案。

OpenAI发布了名为Private Safety Processing(PSP)的系统,旨在解决企业级AI长期存在的一大矛盾:如何在不实际查看数据的情况下,监控复杂AI交互中的安全风险?
Private Safety Processing的工作原理
PSP旨在维护OpenAI对API及企业客户作出的零数据保留(Zero Data Retention)承诺。在这些承诺下,客户数据不会被存储、审查或用于训练。该系统仅向OpenAI传输有限的安全信号,使交互的实际内容对该公司完全不透明。实际上,PSP将安全监控延伸至OpenAI几乎没有可供审查数据的领域。
对这类系统的需求日益增长,源于AI部署日趋复杂,越来越多地涉及较长的多轮交互序列,而非简单的一次性查询。单次交互可能看起来完全无害,但将二十次交互串联起来,其模式可能揭示有人在系统性地探测安全防护,或某个AI智能体正在偏离任务目标。PSP旨在捕获这些多轮交互模式,同时不损害企业客户所要求的隐私保障。
客户在数据处理方面有两种选择:将数据完全保留在自有基础设施中,或将其加密存储在OpenAI的服务器上,加密密钥由客户自行控制。
OpenAI于2026年8月19日宣布该系统,针对API客户的分阶段推出自2026年9月22日开始。随更广泛可用性一同发布的技术白皮书阐述了架构细节,供安全团队评估——在推广开始之际,企业可将其架构与自身部署所需的隐私保障进行权衡。
企业隐私竞赛
OpenAI并非在真空中构建PSP。Anthropic自2026年6月起对某些前沿模型确立了30天的数据保留要求。OpenAI则将PSP定位为相反的路径:该系统并非要求保留数据,而是被设计为在完全不保留数据的情况下运行。对企业买家而言,这一分歧勾勒出协调安全监督与数据控制的两种不同模式:一边是基于保留的审查,另一边是无保留的处理。
早期开发合作伙伴在该功能公开发布前参与了其塑造。Microsoft、Databricks、Glean和Abridge均在开发过程中提供了反馈。
覆盖范围之外的领域
一个重要的注意点:零数据保留功能不适用于ChatGPT的消费者层级,包括Free、Plus、Go和Pro方案。PSP是专属于企业和API的产品,为这类多轮安全监控的可用范围划出了清晰边界。