⚡ 猫叔的AI资讯雷达
产业安全Agent

OpenAI 为前沿模型保留零数据留存机制

OpenAI 将用隐私保护机制识别跨多轮交互的风险,同时不让公司人员接触企业客户的原始内容。

不留存提示词,也要识别长期风险

OpenAI 宣布将继续为前沿模型提供“零数据留存”(Zero Data Retention,ZDR),试图解决企业保密要求与高能力模型安全监测之间日益突出的矛盾。对于符合条件的 API 客户,提示词和模型回复会在请求处理后删除,OpenAI 人员不能查看相关内容;除非客户主动选择加入,这些数据也不会用于模型训练。

公司同时预告了 Private Safety Processing。这套机制旨在识别跨越多轮交互的危险模式,但不会向 OpenAI 人员暴露底层内容。现有兼容 ZDR 的防护措施主要逐次检查请求,较难发现分散在长时间智能体任务中的风险,例如反复试探安全边界、多个账户协同行动,或智能体在收到停止指令后仍继续执行。

企业可以继续把内容保存在自己控制的基础设施中。OpenAI 还在开发另一种方案:数据存放于其平台,但使用客户掌握的密钥加密,OpenAI 自身不持有密钥。自动化安全系统可以处理这些受保护内容,仅向 OpenAI 返回经过严格限定的风险信号。客户可利用自己系统中的信息调查告警,并自主决定是否在申诉或协助核查滥用行为时提供相关材料。

这一方案并未取消所有留存例外。OpenAI 表示,疑似涉及儿童性虐待材料的图片仍会按照法律要求保留,以供人工审核和报告。Private Safety Processing 目前正与早期客户测试,公司计划于 9 月开始推出,并发布技术白皮书。

为什么重要

随着模型能够连续完成更长、更自主的任务,服务商需要结合前后文才能识别滥用行为和偏离用户意图的操作,但这与金融、医疗及专有研发等行业的保密义务存在直接冲突。OpenAI 的方案尝试把“发现风险”与“人员查看原始数据”分离。如果其技术主张能够通过独立检验,客户控制存储位置和密钥的架构可能成为受监管行业部署高能力智能体的重要范式,避免把服务商持续监视企业数据变成安全工作的默认前提。

信源