OpenAI披露遭大规模蒸馏攻击,指控Moonshot AI参与

OpenAI披露遭大规模蒸馏攻击,指控Moonshot AI参与。7月峰值单日1.6万请求涉4000用户,涉及超1.5万名用户提示模式活动,已于28日阻断。

OpenAI 近日披露,其模型遭遇大规模“蒸馏攻击”,并指控与中国 Moonshot AI 相关的个人参与其中。该事件始于 7 月 1 日,OpenAI 警告称,提取其模型的推理数据有助于竞争对手培养高性能模型。

7月24-25日峰值达16000请求

模型蒸馏是一种机器学习技术,通过向源模型发送大量查询以获取输出,进而训练另一个模型来复制更大模型的推理能力和特性。此前,美国联邦政府及包括 Google、Anthropic 在内的主要人工智能公司均指责中国竞争对手——特别是 Moonshot AI——利用该技术复制美国模型的能力。

攻击细节与规模

OpenAI 在周三发布的博客文章中表示,已发现并彻底破坏了几乎整个 7 月进行的敌对蒸馏活动。据博客描述,攻击者并未破解加密或泄露数据库,而是操纵模型交互,使受保护的推理内容以对请求者可见的形式被协调且大规模地重现,此举违反了 OpenAI 的服务条款。

根据 OpenAI 提供的数据,相关查询于 7 月 1 日开始,初期速率缓慢,但在 7 月 24 日和 25 日出现高量峰值。这两个日期共记录了 16,000 个请求,涉及来自 4,000 多个用户的相关提取模式。经过调查,这家 AI 巨头在超过 15,000 名用户中发现了关联的“提示模式活动”。OpenAI 确认,已于 7 月 28 日彻底阻断此次行动。

涉事主体与背景

尽管 OpenAI 表示目前尚不清楚 7 月期间所有操作者是否均隶属于同一家竞争对手 AI 公司,但指出盗窃行为的“核心集群”来自开发 Kimi 模型的 Moonshot AI。截至发稿时,Moonshot AI 未对此做出立即回应。

值得注意的是,就在 7 月底,美国总统唐纳德·特朗普的科技事务助理迈克尔·克拉西奥斯(Michael Kratsios)也曾指责 Moonshot AI 通过蒸馏 Anthropic 的 Fable 模型来创建其 Kimi K3 模型。此外,一周前发布的 Anthropic Claude Opus 5.5 型号中,已引入针对与 Fable 5.1 一同推出的“保存思维”功能的防护措施。

安全担忧与应对措施

OpenAI 强调,对抗性蒸馏构成安全和国家安全风险。X 平台曾指出,提取的推理可用于训练其他模型,而无需保留原始模型面向用户输出的保护措施。OpenAI 补充道,在规模化应用下,蒸馏可以加速先进能力的转移,而无需投入同等的安全资源。随着模型在双重用途领域获得能力,这些担忧日益加剧。

作为回应,OpenAI 采取了一系列防御措施:禁止用于模型复制的账户,加强注册和基础设施控制,并扩大监控范围。该公司还关闭了一个允许拥有其他用户加密推理权限的人重播并恢复内容的途径,并与服务提供商合作,防止此类蒸馏活动转移至第三方服务。此外,OpenAI 已通过边境模型论坛和政府信息共享计划与其他人工智能公司分享了调查细节。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读