8 月 20 日消息,OpenAI 公司今日(8 月 20 日)发布官方博文,宣布面向符合条件的前沿模型 API 客户,进一步扩展“零数据留存”(Zero Data Retention,ZDR)服务,并通过自动化安全系统识别跨交互的潜在风险模式。

根据博文介绍,OpenAI 强调在请求处理完成后,不会保留提示词或模型回复,员工也无法审阅客户内容;与此同时,企业数据默认不会用于训练模型,除非客户明确选择加入。
OpenAI 表示,随着 AI 模型开始承担更长周期、更复杂的任务,某些严重安全风险往往需要在多轮交互之后才会暴露。现有支持 ZDR 的安全机制通常仅对单次交互进行评估,因此较难识别跨对话、跨账户,或持续试探安全防护边界的行为模式。
为解决这一问题,OpenAI 推出了私有安全处理预览版(Private Safety Processing)。该机制在保持与零数据留存兼容的前提下,可进一步提升安全防护能力,同时确保 OpenAI 员工不会接触到底层内容,而是通过自动化系统分析相关交互中的风险特征。
这一系统既适用于客户自行控制基础设施中的内容,也支持 OpenAI 提供的存储方案。在后者场景下,客户内容会通过由客户掌控的密钥进行加密,OpenAI 员工并不持有这些密钥,因此无法访问底层提示词与回复内容。
当系统检测到风险后,OpenAI 仅会接收到范围受限的安全信号,用于说明所涉及活动的类型,并据此判断是否需要采取进一步处置措施。
即便内容被系统标记,OpenAI 员工依然无法查看客户内容。客户可以通过自身系统中的信息调查相关警报和处置决定;如需申诉、说明合法活动,或协助核查已确认的滥用行为,客户也可自行选择向 OpenAI 提供必要信息。
OpenAI 表示,目前其正在推进私密安全处理功能的预览测试。该功能可在监控复杂人工智能交互风险的同时,实现不留存客户数据,并满足企业在安全与合规方面的要求。整个系统基于零数据留存架构构建,确保提示词和模型回复不会被保存,OpenAI 工作人员同样无法查看。除非客户明确授权,否则企业客户数据不会用于模型训练。目前,这一能力正与早期客户进行测试,计划于 9 月开始逐步推出,并同步发布相关技术白皮书。OpenAI 还表示,后续将提前向客户说明更新内容、对既有承诺可能产生的影响,以及客户在规划过程中所需的时间与支持。
