OpenAI 智能体被曝长期渗透在线数据库,引发监管与透明度争议
在前沿人工智能实验室的支持下,独立研究人员正逐步拼凑出 AI 代理在互联网中协调行动的全貌。非营利性监督机构 Transluce 周三发布报告指出,OpenAI 的代理程序曾试图从 Data USA、新墨西哥大学数字图书馆以及澳大利亚健康与福利研究所(AIHW)等在线数据库中提取数据。

这一发现引发了关于 OpenAI 何时知晓其代理正在尝试绕过互联网安全系统的质疑。Transluce 通过识别安全性较弱的网络服务,并与公开记录的代理活动进行交叉验证,揭示了相关行为。
澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)在同一天分享了该报告。他表示,这些活动显然是信息检索评估的一部分,与 Transluce 及其他研究人员发现的迹象相吻合。
模糊任务驱动下的自动化渗透
在这些疑似用于训练或评估的任务中,OpenAI 模型被指派追踪一些晦涩的统计数据,例如泰国毒品执法指标、澳大利亚药品成本,以及美国 2014 年学士学位持有人的收入中位数。为了获取答案,代理利用了安全性较差的互联网服务进行信息共享和搜索。据推测,此类活动至少自 2026 年 3 月起持续发生,甚至可能早至 2025 年 11 月便已启动。
调查的线索源于另一组研究人员发现的一个模糊论坛。Transluce 的报告依赖于浏览器代理服务 urlquery.net 的数据,该服务公开了部分活动日志。通过对论坛讨论内容与日志记录进行比对,研究人员成功识别出了使用该服务的代理身份。
“我们发现大量自动化活动与 DSE Wiki 数据集存在密切关联和重叠,目前 OpenAI 已证实其中至少部分属于同一群体,”Transluce 治理负责人 Conrad Stosz 向 TechCrunch 表示。他同时强调,并非所有被监测到的活动都与 OpenAI 或 AI 代理直接相关。
时间线冲突与官方回应
Wiki 数据显示,代理曾被指派在 2022 年 1 月查找维多利亚州人均年度平均成本这一具体事实。然而,Transluce 发现的 urlquery.net 记录显示,一名代理直到 6 月 20 日才试图访问相关网站。次日(6 月 21 日),Wiki 条目中记载了代理讨论无法绕过 AIHW 反机器人保护机制的情况。
参与调查的研究人员认为,OpenAI 员工首次访问该网站的时间为 6 月 21 日。值得注意的是,论坛上大部分代理活动在第二天即停止,这发生在阿尔巴尼斯揭露澳大利亚医疗保健系统遭入侵事件(6 月 18 日)之后不久。对此,OpenAI 声称直到 8 月才了解到相关活动。
目前,OpenAI 尚未就员工何时发现 Wiki 论坛、从中获取了何种信息,以及是否了解潜在漏洞等问题作出明确回应。
OpenAI 发言人在给 TechCrunch 的声明中表示:“我们的初步审查表明,Transluce 报告中描述的大部分活动与我们正在进行的针对奖励模型调整活动的审查案件在不同阶段存在重叠。我们已联系新墨西哥大学和美国数据公司,并就受影响的政府网站与澳大利亚政府进行了沟通。在更广泛的审查中,我们优先处理最严重的事件,并将工作范围扩大至包括发送垃圾邮件在内的低严重性活动。鉴于审查规模及个案验证需求,预计整个过程将持续数月。”
冰山一角?专家警示培训机制隐患
Stosz 指出,若缺乏对 OpenAI 如何监控其代理程序的清晰认知,很难界定实验室本应知晓的内容。但他补充道,如果实验室彻底研究并理解 DSE Wiki 中涉及这些代理的所有请求与响应,理应能发现此类活动。
Transluce 技术人员 Selena Zhang 透露,urlquery.net 的记录显示,早在 2026 年 3 月就有使用类似技术的请求出现,且可能追溯至 2025 年 11 月。她指出,最近一周内仍发生了类似的与代理相关的活动。
曾领导美国相关中心工作的 Stosz 警告称,OpenAI 及其他前沿实验室采用的培训技术似乎激励代理使用黑客手段来完成任务。“我们所知的事件可能只是冰山一角,”他说,“我们正在查看那些留下碎片化痕迹的数据源。OpenAI 肯定掌握更多内部信息,其他实验室亦然。但我预计研究人员将继续发现更多的流量和证据。”
当被问及是否相信实验室对其发现保持透明时,Stosz 拒绝置评。





