OpenAI 为欧盟版 ChatGPT 添加隐形文本水印

OpenAI为欧盟版ChatGPT添加隐形文本水印。该功能响应欧盟《人工智能法》,通过调整词汇选择嵌入内容,复制粘贴时随文传播。目前仅限欧盟用户及API开发者启用,非全球默认选项。

OpenAI 周一通过博客宣布,将开始为欧盟地区 ChatGPT 和 Codex 生成的文本添加隐形水印。这一举措旨在响应欧盟《人工智能法》的透明度规则,该规则已于 8 月 2 日正式生效,要求人工智能公司以其他系统可识别的方式标记由 AI 产生的内容。

替换10%单词致检测率降

根据计划,该水印功能将在未来几周内面向所有符合条件的 ChatGPT 和 Codex 用户推出,但仅限欧盟地区。与此同时,使用 OpenAI API 的开发人员从今天起即可在全球范围内为选定的模型开启此功能,默认状态为关闭。OpenAI 明确表示,不会在发布初期将文字水印设为全球默认选项。

这种水印并非传统的视觉符号,而是通过微妙地调整模型的词汇选择来实现。由于水印信息嵌入在文本本身中,当内容被复制和粘贴时,水印也会随之传播。OpenAI 指出,水印无法用于识别具体用户,且其模型的性能未因此发生显著变化。

为支持这一技术,OpenAI 联合宾夕法尼亚大学和耶鲁大学的研究人员发布了一份名为 textGrain 的技术报告。报告显示,结合数百个点击数据,检测器仅凭文本和密钥即可有效识别出人工智能生成的内容。

然而,编辑操作可以移除水印。OpenAI 的测试表明,若用同义词替换 10% 的单词,检测率将从 92% 降至 66%。此外,短段落、数学答案以及翻译文本也被证实难以被准确检测。鉴于这些局限性,OpenAI 决定初期仅向经批准的研究人员和专家组织提供探测器访问权限。

OpenAI 同时发出警告,“缺少水印”并不等同于“人为创作”。文本可能因篇幅过短或经过过度编辑而缺失水印特征。公司强调,水印仅能表明部分段落由 OpenAI 系统生成或处理,但无法量化其中包含的人类判断、编辑或创造力的比例。

此前,《华尔街日报》在 2024 年曾报道,OpenAI 已建立文本水印技术,但因担心用户流失至无水印的竞争对手而暂缓发布。目前,Anthropic、Google、Meta、Microsoft 和 OpenAI 均已承诺遵守欧盟关于 AI 生成内容的行为准则。值得注意的是,Anthropic 表示将在 Claude 生成的文本上实施全球范围内的水印措施,这一决定引发部分用户争议,他们认为自身提供了指令、背景和决策,Claude 仅是工具。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读