微软OpenAI内部文件忧AI训练新闻侵权

纽约时报版权诉讼公开文件显示,微软与OpenAI高管曾担忧AI模型训练使用新闻内容,有人称其类似“人类历史上最大的劳动力盗窃”,并提到绕过付费墙、删除版权声明等操作;微软否认相关员工表述。

最新公开的法庭文件显示,Microsoft 与 OpenAI 的高管层内部对 AI 模型训练所依赖的新闻内容使用方式存在严重担忧,有高管甚至将其形容为"人类历史上最大的劳动力盗窃"。这些言论出自"纽约时报"于 2023 年对 OpenAI 和 Microsoft 提起的版权诉讼,目前仅有部分删节文件片段对外公开,缺乏完整上下文。

据英国"纽约时报"报道,微软 AI 部门的布伦特·赫赫特(Brent Hecht)认为,OpenAI 的训练方式类似于"人类历史上最大的劳动力盗窃",并可能引发"厄运循环"(doom loop);OpenAI 员工尼克·塔利(Nick Turley)则称,这种做法构成了"对出版商的生存威胁"。

微软否认员工“盗窃”说法

除上述引述外,这批未删节材料还揭示了 OpenAI 及其合作伙伴构建训练数据集的部分操作方式,包括绕过付费墙获取训练内容、删除数百万份文件,以及在训练数据中去除版权声明等。

该案是"纽约时报"联合其他五位作者共同发起的版权诉讼的一部分。原告方主张,大型科技公司在未经批准、也未支付报酬的情况下,将互联网上的数百万篇新闻报道抓取并用于训练大型语言模型(LLM),违反了版权法。

目前多起同类诉讼的判决结果偏向 AI 公司一方,但相关法官已明确表示,如此裁决是因为围绕 AI 内容使用的法律问题尚未厘清。"纽约时报"的这起诉讼被视为判定 AI 公司能否合法使用此类训练数据的关键案件。

在此背景下,Microsoft 与 OpenAI 高管的内部评论显得格外引人注目,尽管 Microsoft 方面否认了自家员工的上述表述。Microsoft 回应称:"Microsoft 的立场已在法庭文件中阐明,解释了为何这类变革性使用符合版权法,以及 Copilot 为何无法取代出版商提供的新闻。"

文件中还有不少措辞相对克制、但同样指向负面判断的言论。一份 2023 年的 Microsoft 内部文件写道,"全球数亿人很快将认为,大型模型'摄取'他们的全部作品是一场规模空前的惊人盗窃"。另有员工在写给 OpenAI 总裁格雷格·布洛克曼(Greg Brockman)的信中表达了类似担忧。

从这些文件可以看出,公司管理层早已意识到 AI 对新闻采集与新闻行业运转的潜在冲击。赫赫特在另一处评论中称,大型 AI 模型是"一种会破坏自身供应链的产品"。OpenAI 的一名软件工程师也在 2023 年向同事表示:"无论我们把链接展示得多么醒目,用户都不会点击。"塔利对此予以认同,称 AI 产品"在很大程度上已经可以替代新闻"。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读