OpenAI为ChatGPT文本上线隐形水印技术 封面图
技术进展

OpenAI为ChatGPT文本上线隐形水印技术

Heooo 10月06日04时59分 5 阅读

「OpenAI宣布将在欧盟为ChatGPT与Codex生成的文本添加不可见水印,以符合欧盟人工智能法案的透明度要求。该水印不显示符号,而是通过影响模型用词留下可检测模式,并随文本复制粘贴迁移,方法名为textGrain。开发者可通过API为部分模型开启,默认关闭。」

OpenAI近日在一篇博客文章中宣布,将在欧盟范围内为ChatGPT与Codex生成的文本加入不可见水印,以满足欧盟人工智能法案的透明度要求。该法案的相关条款已于8月2日生效,要求AI企业以其他系统能够识别的方式标注AI生成内容。按照OpenAI的说明,水印将在未来几周内陆续推送给欧盟地区所有订阅方案的合格ChatGPT与Codex用户,但仅限欧盟境内生效。

与外界想象的把标记符号塞进文字不同,这项水印并非可见字符,而是通过微妙地塑造模型的用词选择,留下一种读者无法察觉、检测器却能捕捉的模式。由于水印藏在词语本身之中,当文本被复制粘贴到别处时,它会随文字一同迁移。OpenAI强调,水印不会识别用户身份,并且公司没有观察到开启水印后模型性能出现有意义的变化。

OpenAI为ChatGPT文本上线隐形水印技术

配合这次公告,OpenAI还发布了一份技术报告,介绍其水印方法,名为textGrain。该报告与宾夕法尼亚大学和耶鲁大学的研究人员共同撰写,展示了这样一个流程:使用一把秘密密钥对下一个词的预测进行排序,以此完成句子。把数百次这样的微小引导叠加起来,检测器就能仅仅依靠文本和密钥,识别出哪些内容由AI生成。这套思路的关键在于,单一处的用词偏移几乎不可察觉,但累积之后会形成统计上可被捕捉的规律。

在开放节奏上,OpenAI给出的方案相当谨慎。全球任何地区使用OpenAI API的开发者,从即日起都可以为部分模型开启该功能,但它默认处于关闭状态。OpenAI明确表示,在发布初期不会把文本水印设为全球默认选项。这种分阶段推进的做法,既照顾了欧盟合规的时间表,也保留了其他市场用户的体验与选择空间。

水印的稳健性也被OpenAI坦率地摆上台面。公司的测试表明,人工编辑确实可以削弱甚至去除水印。在一项测试中,只要把10%的词语替换为同义词,检测率就从约92%下降到66%。此外,短段落、数学答案以及翻译后的文本也更难被检测出来。OpenAI表示,这些局限促使其在初始阶段仅向经过批准的研究人员和专家组织开放检测器权限,以便共同评估可靠性与负责任的使用方式。

OpenAI同时提醒,缺少水印并不能证明文本由人类撰写。文本可能过短、被大量编辑,也可能来自其他公司的AI系统。水印能够表明某个OpenAI系统生成或处理过某段文字的一部分,却无法说明其中包含多少人类判断、编辑或创造力。这一表态实际上划定了水印能力的边界:它是溯源与标识的辅助信号,而不是判定作者身份的最终证据。

从行业视角看,OpenAI并非第一家采取此类举措的公司。两个月前,Anthropic已宣布为Claude生成的文本添加水印,并在全球范围应用,该决定曾引发部分Claude用户的不满,他们认为自己提供了指令、上下文与决策,Claude只是工具。据《华尔街日报》2024年的报道,OpenAI此前其实已经构建过文本水印,但出于担心用户转向不加水印的竞争对手等原因而推迟发布。目前,Anthropic、Google、Meta、Microsoft与OpenAI等公司均已承诺遵循欧盟关于AI生成内容的实践准则,文本水印正逐渐成为大模型产品的一项基础能力。

# OpenAI # 文本水印 # AI生成内容标识

来源:Heooo AI工具导航