政策法规

AI行业被称史上最大规模劳动成果盗窃

Heooo 09月19日03时34分 34 阅读

「《纽约时报》与 OpenAI、微软的版权诉讼中,一份解封动议援引微软应用科学主管赫克特与 OpenAI 总裁布罗克曼的表态,称 AI 训练存在大规模劳动成果复制,生成式 AI 对出版商构成生存威胁。原告认为这足以击穿合理使用抗辩,案件预计在 2027 年决定是否进入正式审判。」

《纽约时报》与 OpenAI、微软之间的版权诉讼仍在持续推进。近期一份被解封并完整公开的动议显示,多名 AI 行业高管在相关陈述中承认,训练 AI 模型的过程中存在规模惊人的内容复制行为,这一表态被原告一方视为支撑其核心主张的关键证据。

据外媒报道,这份动议由《纽约时报》一方提交,并经数字媒体倡导人士杰森 · 金特披露,其中直接援引了微软应用科学主管布伦特 · 赫克特以及 OpenAI 联合创始人兼总裁格雷格 · 布罗克曼的原话。赫克特将 AI 产业的大规模建设形容为“人类历史上规模最大的劳动成果盗窃”。而《纽约时报》则指控 OpenAI 与微软在未获许可的情况下,完整复制了其数百万篇受版权保护的文章,用于生产具有替代效应的商业 AI 产品。在这样的指控背景下,赫克特的说法被认为对两家公司尤为不利。

布罗克曼的表述同样被原告引用。他表示,生成式 AI 让出版商面临“生存威胁”,因为这类产品本质上就是替代品,而且随着模型能力不断提升,其替代性只会越来越强。原告律师据此认为,这些表态足以彻底摧毁被告关于合理使用的抗辩。动议显示,赫克特本人也承认,如果被告凭借这一抗辩胜诉,可以说将彻底把“合理使用”这一概念变成笑话。这一说法与原告的判断形成了呼应,也让围绕 AI 训练数据来源的争议再次成为行业焦点。

从技术角度看,这场争议的核心在于大模型训练数据的获取边界。当前主流的大语言模型与多模态模型,普遍依赖对海量公开文本、图像与网页内容的抓取与学习,而其中相当一部分内容受版权保护。如何在模型能力提升与内容创作者权益之间建立可持续的平衡,已经成为 AI 行业无法回避的问题,也直接影响未来数据获取方式、模型训练流程以及相关工具的合规设计。对于开发者而言,数据集来源的可追溯性与授权状态的清晰化,正逐渐从可选项变成必选项。

据 IT 之家了解,这场诉讼始于 2023 年。当时《纽约时报》指控两家公司不仅大量抓取其原创新闻内容,还利用这些内容训练 AI 产品,与传统新闻机构争夺市场。近期的消息显示,这场法律战仍远未结束,主审法官预计将在 2027 年某个时候决定是否允许案件进入正式审判。无论最终结果如何,围绕训练数据合法性的讨论都将继续影响 AI 产品的研发路径与行业规范。

# OpenAI # 微软 # AI版权 # 训练数据

来源:Heooo AI工具导航