《纽约时报》诉OpenAI案再添新证据:被指向知威胁出版商生存仍大量复制内容
《纽约时报》与OpenAI、微软之间的版权诉讼日前出现新的进展。据英国《金融时报》报道,《纽约时报》在周四提交的最新诉讼文件中指控,OpenAI在明知其AI技术对出版商构成"生存威胁"的情况下,仍复制了数百万篇受版权保护的文章,用于训练潜在价值高达"天文数字"的AI系统。
目前,《纽约时报》及其他媒体机构正向OpenAI和微软追讨数十亿美元的损害赔偿。此案的核心争议在于,两家公司未经许可利用出版商内容训练AI模型是否侵犯版权法。这起案件也是版权持有人针对AI公司提起的数十起诉讼中最受瞩目的一个,后者被指控盗用内容训练模型,进而威胁人类内容创作者的工作岗位。

OpenAI高层言论成关键证据
《纽约时报》律师在文件中表示,OpenAI受商业利益驱动,大规模获取该报内容。文件援引OpenAI联合创始人、现任总裁格雷格·布罗克曼(Greg Brockman)约2017年的话称,他"被那些天文数字般的财富深深驱动",希望借OpenAI技术的商业化获得这笔财富。
文件还披露,OpenAI旗下ChatGPT负责人曾写道,AI产品对出版商构成"生存威胁",称这些产品"在很大程度上具有替代性,就是这样,而且随着它们变得更好,替代性会越来越强"。《纽约时报》方面据此认为,OpenAI是在明知其工具可能取代原始材料的情况下仍持续复制内容,"未经许可,反复完整复制数百万篇受版权保护的文章,以开发具有替代性的商业AI产品"。
此外,诉讼还引用了微软应用科学总监布伦特·赫克特(Brent Hecht)的言论。赫克特据称写道,用受版权保护的内容训练大语言模型是"一场规模空前的惊人盗窃",此案胜诉将"彻底嘲弄'合理使用'这一理念"。
绕过付费墙获取内容引发争议
诉讼文件称,OpenAI采用了"越界且具有欺骗性"的手段获取付费墙后的内容。文件显示,当一名员工告知布罗克曼"有办法绕过《纽约时报》付费墙"时,后者回应称:"啊,不错。"《纽约时报》律师指出,作为OpenAI总裁、实际上的二号高管,布罗克曼当时已知悉这一做法。
微软CEO萨蒂亚·纳德拉(Satya Nadella)在为该案所作的证词中表示,如果他当时"得知OpenAI抓取并利用付费墙后的信息进行训练",他将依据两家公司当时的协议行使微软的权利,要求OpenAI"重新训练其模型"。
数据称AI工具大幅压低原始内容点击
微软内部的一项发现也对被告方不利:与传统搜索引擎相比,使用其AI回答工具的用户对原始内容的点击率低了83%至93%。
双方回应
OpenAI的立场则是,根据版权法,利用公开可获得的内容训练模型属于"合理使用",其法律依据与搜索引擎访问相关内容时类似。该公司此前表示,其大语言模型是对原始内容进行转换而非复制,不会成为《纽约时报》或其他出版物的替代品,并称"本案不是人类创作与AI之争,而是《纽约时报》想以牺牲惠及所有人的进步为代价,谋求一笔不该得的横财"。OpenAI未立即对最新文件置评。
微软方面则在声明中回应称,赫克特的言论"反映的是一名员工的个人观点,并非法律分析",并表示纳德拉的证词"谈的是广泛原则以及人们查找和消费信息方式正在发生的变化",并非对本案核心"版权问题的结论"。





