OpenAI推出隐私安全处理对抗对手 封面图
行业资讯

OpenAI推出隐私安全处理对抗对手

Heooo 08月20日06时30分 19 阅读

「OpenAI预览一项名为“Private Safety Processing”的新服务,通过自动化系统监控AI滥用行为,同时不保留任何客户数据。此举旨在与Anthropic近期对“覆盖模型”保留30天会话数据的政策形成对比,回应企业对敏感数据隐私的担忧,并扩大零数据保留的监控范围。」

随着AI模型能力的日益增强,其被滥用的潜在风险也在同步上升,业界对于安全护栏的呼声愈发高涨。如何在尊重企业客户隐私的同时,有效监控潜在的滥用行为,成为AI公司必须谨慎权衡的课题。OpenAI近日宣布预览一项名为“Private Safety Processing”的新服务,试图在隐私保护与安全监控之间找到更优解。

这项新服务面向部分精选客户开放,其核心机制在于:通过自动化系统监控潜在的滥用行为,同时不保留客户的任何数据。这一做法明显与竞争对手Anthropic近期公布的数据保留政策形成对立。Anthropic的政策要求对其“覆盖模型”(包括所有Mythos级模型以及“具有类似能力的未来模型”)的用户会话数据保留30天,以便进行安全审查和分析。然而,这一政策引发了不少处理大量敏感数据企业的深切担忧,他们不希望自己的数据被AI实验室长期存放或检查。

OpenAI推出隐私安全处理对抗对手

与大多数AI公司一样,OpenAI此前已经通过“零数据保留”(ZDR)政策为客户提供了一定程度的隐私保障。ZDR机制利用OpenAI API中的代理程序,对每次会话进行滥用监控,这样客户数据不会被公司保留,同时仍然能够扫描不良活动,且无需人工介入。值得注意的是,Anthropic在大部分情况下也遵循ZDR,但对其“覆盖模型”(如Fable)例外。

OpenAI表示,Private Safety Processing是一项新技术,它扩大了ZDR的适用范围。这种技术被描述为一种“长时程安全监控”方式,能够评估多次对话的输入和输出——而非仅限于单次对话。监控依然由代理程序执行,一旦被触发,它会捕获交互数据,并跨会话分析是否存在潜在滥用迹象。这一机制有助于OpenAI检测那种分散在多个会话中的恶意使用行为。例如,一个试图开发恶意软件的攻击者,可能会把请求分散在不同会话中,以规避单次检测。Private Safety Processing能够在不经过人工审查用户对话的前提下,分析这些跨会话的请求模式,识别潜在的滥用风险。

OpenAI推出隐私安全处理对抗对手

当系统被触发时,它会向OpenAI发送一个“窄定义的信号”,用以警告特定类型的活动。OpenAI可以依据该信号决定是否“需要执行强制措施”。如果确有需要,OpenAI会联系客户,以获取更多上下文信息,或与客户共同解决问题。这一流程设计旨在最大限度地减少对用户数据的接触,同时保留必要的安全响应能力。

此次OpenAI推出Private Safety Processing,显然是在安全与隐私的平衡点上主动出击,与Anthropic的30天数据保留政策形成了鲜明对比。此举不仅回应了企业对数据隐私的强烈诉求,也可能推动整个行业重新审视安全监控策略中数据保留的必要性与边界。在AI滥用风险持续演变的背景下,如何构建既有效又尊重用户隐私的安全机制,将成为各大AI实验室竞争的新焦点。

# OpenAI # 隐私保护 # AI安全

来源:Heooo AI工具导航