OpenAI 零数据保留政策与新安全处理预览:如何在隐私与安全之间取得平衡

事件概述

2026 年 8 月 19 日,OpenAI 官方发布了一篇重要公告,重申了针对合格 API 客户的 Zero Data Retention(零数据保留) 政策承诺,并同步预览了一项名为 Private Safety Processing 的新功能。该功能旨在强化跨交互场景下的安全防护,同时保持与 ZDR 政策完全兼容。

简而言之,OpenAI 的核心承诺是:对于符合条件的 API 客户,OpenAI 不会在请求处理完成后保留其提示词和模型响应。客户内容不会提供给 OpenAI 人员进行审查注释,企业客户数据也不会用于训练模型,除非客户明确选择加入。

关键技术点

1. Zero Data Retention(ZDR)的现有机制

ZDR 是一项明确的隐私承诺,其核心保障包括:

  • 请求处理完毕后,OpenAI 不保留客户的 prompts 和 model responses;
  • 客户内容对 OpenAI 员工不可见,不用于人工审查;
  • 企业客户数据不用于模型训练(除非显式 opt-in)。

这一机制使得许多对数据合规有严格要求的企业能够放心使用 OpenAI 模型。

2. Private Safety Processing 的必要性

随着 AI 模型承担更长时间、更复杂的任务(如 Agent 工作流),某些高风险行为只有在多个交互的上下文中才会显现。例如:

  • 恶意行为者反复探测安全边界;
  • 跨账号协调攻击;
  • 将恶意意图伪装成例行研究;
  • Agent 在执行过程中偏离用户意图,例如在收到“停止”指令后仍继续行动。

现有的 ZDR 兼容安全系统只能对单个交互逐一评估,无法关联多个相关交互来分析风险模式。因此,OpenAI 推出了 Private Safety Processing,其目标是在不向 OpenAI 人员暴露底层内容的前提下,识别跨相关交互的风险模式。

3. 技术架构:内容与信号分离

Private Safety Processing 的关键技术设计体现在存储与访问控制上:

  • 客户自有基础设施:在 ZDR 部署中,客户内容仍保留在客户控制的基础设施上;
  • OpenAI 托管存储:OpenAI 正在开发一种选项,将内容加密存储在 OpenAI 基础设施上,但加密密钥由客户控制。OpenAI 人员不持有这些密钥的副本,因此无法解密和访问底层内容。

当自动检测系统发现风险时,OpenAI 仅接收一个窄化的安全信号,指示涉及的活动类型,而非具体内容。OpenAI 人员即使在标记事件时也无法获取客户内容。

客户可以自行调查告警和执行决策(因其系统中有自己的信息),如需申诉或配合已核实的滥用调查,可自行决定是否与 OpenAI 共享相关信息。

4. 当前状态与时间表

Private Safety Processing 目前正在与早期客户进行测试。OpenAI 计划在 2026 年 9 月 开始推广该功能,并同步发布技术白皮书。

对数据科学和 AI Agent 落地的意义

这篇文章对数据科学社群和 AI Agent 落地具有多层意义:

第一,它为高敏感行业(如金融、医疗、法律)使用前沿模型扫清了障碍。 文章特别提到,许多前沿模型部署目前要求客户允许提供商保留敏感内容以用于安全监控,这往往与组织的安全义务和用户承诺相冲突。Private Safety Processing 提供了一种“既保留安全监测能力,又保持数据控制权”的中间路径。

第二,它为 Agent 安全监控提供了可行的隐私框架。 正如文中所言,Agent 任务中的风险往往在任务过程中逐步展开。跨交互安全分析能力对确保 Agent 不超出其预期权限至关重要。Private Safety Processing 使得这种跨交互监控在 ZDR 条件下也能实现。

第三,它示范了一种新的产品设计哲学:将“内容”与“信号”分离。 系统需要看到什么、人能看到什么、什么可以被长期保留——三者被清晰区分。这种设计思路很可能成为未来 AI 安全基础设施的标准参考架构。

我的技术点评

优点

OpenAI 此次公告在工程与产品层面的平衡感很好。通过“客户持有密钥”的加密模型,以及“只返回窄化信号”的信息暴露策略,它尽可能地避免了核心隐私承诺与安全监控需求之间的零和冲突。文中引用了 Glean 的 CISO Sunil Agrawal 的背书,也表明企业客户对这一方向的认同。

值得关注的落地难点

不过,有几个细节值得保持审慎关注:

  • 窄化信号的具体定义和误报率未在文中展开。如果信号粒度过粗,可能导致误报率偏高;如果过细,又可能间接泄露内容信息。这块技术细节只能等待 9 月的白皮书揭晓。
  • “相关交互”的关联方式是另一个关键未说明点。即系统如何判断哪些交互属于同一个“相关会话”,这在分布式系统中的实现复杂度不低。
  • 法律例外:OpenAI 在脚注中明确,法律要求的儿童性虐待材料(CSAM)报告义务仍将执行,相关图像即使在 ZDR 部署中也会被保留用于人工审查和法律报告。这一点是合理且必要的例外,但也提醒我们 ZDR 并非绝对零保留。

总结

总体而言,这是一篇面向企业客户的产品前瞻公告,而非技术细节论文。但它的方向性意义重大:在监管环境日益严格、企业对数据主权要求不断提高的背景下,零数据保留与高级安全监控的兼容方案将成为顶级模型提供商的核心竞争力。期待 9 月白皮书带来更多工程细节。

原文链接

https://openai.com/index/offering-zero-data-retention-for-frontier-models