OpenAI扩展零数据留存安全机制
「OpenAI宣布面向符合条件的API客户扩展零数据留存服务,并预览推出私密安全处理机制,用自动化系统分析跨交互风险模式,且不暴露员工审查。该能力将于9月推出,并发布技术白皮书。」
OpenAI公司近日发布博文,宣布面向符合资格的前沿模型API客户,扩展“零数据留存”(Zero Data Retention)服务。该服务强调在请求处理完成后,OpenAI不会保留提示词或模型回复,员工也无权审阅客户内容。除非客户明确选择加入,否则企业数据不会被用于模型训练。这一机制旨在为企业客户提供更强的数据隐私保障,减少敏感信息暴露风险。
随着大模型承担的任务越来越长、越来越复杂,部分严重的安全风险往往需要多轮交互才能显现。然而,现有兼容零数据留存的安全系统通常采用逐条评估的方式,难以识别跨对话、跨账户或持续试探安全机制的行为模式。这种局限性可能导致某些隐蔽的恶意活动无法被及时捕获,从而削弱安全防护的整体效果。
为解决这一痛点,OpenAI以预览版形式推出了“私密安全处理”(Private Safety Processing)机制。该机制的核心思路是:在不允许OpenAI员工接触底层内容的前提下,利用自动化系统分析关联交互中的风险模式。系统既适用于客户自行控制基础设施中的内容,也适用于OpenAI提供的存储空间。在后一种场景中,客户内容由客户控制的密钥进行加密,OpenAI员工不持有这些密钥,因此无法读取底层的提示词和回复。
当自动化系统识别出风险后,OpenAI只会收到范围受限的安全信号,用于说明涉及的活动类型,并据此判断是否需要采取处置措施。值得注意的是,即使内容被标记,员工仍然无法查看客户的具体内容。客户可以通过自身系统中的信息来调查警报和处置决定;如果客户需要申诉、说明合法活动,或协助核查已确认的滥用行为,也可以自行选择向OpenAI提供相关信息。
OpenAI表示,私密安全处理目前正在与早期客户进行测试。该公司计划于9月开始正式推出这一能力,并同步发布技术白皮书。届时,OpenAI会提前向客户说明更新内容、对既有零数据留存承诺的影响,以及客户进行规划所需的时间与支持。这一举措在隐私保护与安全检测之间寻求新的平衡,可能成为企业级AI服务中数据治理的重要参考方向。
来源:Heooo AI工具导航