政策法规

OpenAI版权诉讼曝GPT写作细节

Heooo 09月09日19时33分 36 阅读

「美国作家协会诉OpenAI案进入关键阶段,作者方提交简易判决动议,指控OpenAI未经许可使用194部图书训练模型,并援引员工言论称GPT-5可代写《冰与火之歌》。OpenAI则坚持合理使用抗辩,案件涉及微软及130亿美元投资。」

美国作家协会针对OpenAI和微软提起的集体诉讼近日出现新进展。根据提交至纽约联邦法院的简易判决动议,多名图书作者要求法官认定OpenAI未经许可复制其版权作品,且该行为不构成合理使用。动议涉及194部图书,当前阶段仅寻求认定责任,尚未涉及赔偿金额裁定。

原告方指出,OpenAI曾从大型盗版书库LibGen获取训练资料,并在GPT-3技术论文中将相关数据集从“Libgen1”“Libgen2”改称为“Books1”“Books2”。作者代表认为,这一命名调整意在淡化训练数据来源与LibGen之间的关联,进而掩盖未经授权的复制行为。诉讼材料还称,OpenAI在2022年夏季因法律顾虑删除了上述两个LibGen文件集合,并指出这可能是OpenAI迄今唯一删除过的训练语料库,暗示早期GPT模型确实使用过这些资料。

备受关注的是,《冰与火之歌》作者乔治·R·R·马丁为本案原告之一。原告方援引OpenAI员工Tarun Gogineni的公开帖文作为证据。Gogineni于2022年加入OpenAI,负责提升模型写作质量。他在帖文中表示,其“研究任务”是让GPT模型写出《冰与火之歌》的“最后2本书”,并假设即使马丁去世,GPT-5也能“自动补全”该系列。原告认为,Gogineni清楚相关技术可能冲击作者职业,并将其影响称作“可接受的经济扰动”。这一证据强化了作者群体对AI替代创作风险的担忧。

案件另一焦点是微软的连带责任。作者方主张,微软作为OpenAI的重要投资方和技术合作方,能够监督OpenAI的相关行为并从中获益,因此应承担共同责任。诉讼文件显示,微软在2019年、2021年和2023年签署的三项协议中,累计向OpenAI投资约130亿美元,折合人民币约874.67亿元。原告认为,巨额投资和深度合作使微软对OpenAI的训练行为具备实质性影响力和收益权。

面对指控,OpenAI同日提交了交叉动议,坚称其对图书的模型训练依法属于“合理使用”。该公司此前反复强调,利用公开材料训练AI模型符合知识产权法的合理使用范畴,且通过数据清洗和来源管理降低了侵权风险。然而,原告方主张,LibGen文件的删除行为本身即说明OpenAI意识到其训练数据存在问题,不能简单以训练目的抵消来源合法性争议。

这起诉讼被视为AI行业版权博弈的标志性事件。若法院对“合理使用”作出限制性解释,将影响大模型训练中获取版权材料的边界,改变数据构建与合规审查的行业标准。同时,GPT-5在不同创作场景中的能力展示,也促使外界重新审视AI辅助写作与原创作者权益之间的平衡。目前案件仍处于责任认定阶段,后续进展值得技术界与版权界持续关注。

# OpenAI # 版权诉讼 # 合理使用 # AI训练数据 # 微软投资

来源:Heooo AI工具导航