微软OpenAI内部文件曝光:高管曾警告AI对新闻业构成威胁

《纽约时报》诉讼公开微软和OpenAI内部文件,显示员工担忧AI训练新闻涉版权,聊天机器人或替代新闻网站并致流量下降。微软称属合理使用,文件仅为个人观点;OpenAI未回应。

在《纽约时报》等美国新闻机构持续推进针对微软、OpenAI 训练数据版权问题的诉讼过程中,一批此前被标记为机密的内部文件正式公开,揭示了这两家公司内部员工对 AI 影响的担忧。

公开文件显示,微软应用科学部门主管 Brent Hecht 在内部文件中警告,将新闻内容用于 AI 训练是“前所未有的大规模盗窃”,甚至可能是“人类历史上规模最大的劳动力盗窃”。在另一份文件中,他还对微软和 OpenAI 关于 AI 训练新闻内容属于合理使用(Fair Use)的观点提出质疑,认为大规模抓取新闻内容的做法与“合理使用”的理念相悖。

微软内部文件还曾提及所谓“毁灭循环(doom loop)”风险,即 AI 产品不断减少新闻网站的流量和收入,迫使新闻机构缩减内容生产,而 AI 模型也将因此失去可靠的信息来源

微软内部数据似乎已呈现这一趋势。微软的数据显示,部分涉诉新闻机构的点击率下降了 83% 至 93%,另一些机构的降幅则介于 51% 至 94%。新闻机构还援引 ChatGPT 搜索结果点击率较低的报道以及自身流量下降的情况,认为 AI 聊天机器人正在逐步取代用户直接访问新闻网站的需求。

微软 CEO Satya Nadella 在作证时也承认,聊天机器人能够直接在 AI 平台向用户提供信息,减少用户访问原始新闻网站的需求。他称,这相当于聊天机器人通过直接提供信息,“从新闻网站那里拿走了点击量”

OpenAI 内部同样存在类似判断。ChatGPT 负责人 Nick Turley 曾在内部确认,使用新闻内容训练商业 AI 产品,并让这些产品取代新闻提供商,可能给出版商带来“生存性威胁”。他认为,当聊天机器人已经直接提供信息时,用户“没有充分理由”再点击原始链接,并在内部讨论中将聊天机器人描述为“基本上具有替代性”,随着产品能力提升,这种替代关系还会进一步增强。

以《纽约时报》为首的新闻机构还指控,微软和 OpenAI 内部人员早已意识到 AI 产品可能输出与训练数据高度相似的内容。原告方表示,其开展了多种测试,尝试让两家公司的 AI 产品直接复现新闻文章内容,结果出现了大段内容复现的情况。

新闻机构认为,微软和 OpenAI 并未充分采取措施阻止此类输出,反而采取了让新闻机构更难测试 AI 模型的做法。Brent Hecht 的一份内部文件显示,公司开发了一项过滤机制,可能让训练数据版权方“更难了解哪些内容被用于训练”

针对上述指控,微软发言人回应称,微软的 AI 产品属于具有转换性质的合理使用,不会取代新闻网站,并强调 Hecht 的内部文件仅代表一名员工的个人观点,不构成法律分析,也不能代表微软公司的立场。OpenAI 截至报道发布时尚未回应相关置评请求。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读