AI“幽灵”作者现身:大型语言模型生成的虚假专家正污染科学文献
埃莱娜·瓦斯克斯(Elena Vasquez)声称自己在2019年于刚果民主共和国尼拉贡戈山露营了三个月,那里的二氧化硫气味混合着烂鸡蛋和火柴的味道。她的同事马库斯·陈(Marcus Chen)则宣称在四大洲目睹了11次火山爆发。这些经历被发布在名为“Volcanoes Explored”的网站上。

然而,根据6月1日发布的一份预印本论文揭示,瓦斯克斯和陈并非真实存在的火山学家,而是由人工智能生成的大型语言模型(LLM)创造的虚构身份,即所谓的“幽灵”作者。
波兰华沙三星AI中心(Samsung AI Center Warsaw)的计算机科学家 Neo Christopher Chung 和 Michał Brzozowski 指出,这类假专家广泛存在于互联网上,角色涵盖区块链专家、宇航员、董事会成员及播客主持人等。他们的研究重点在于评估这些AI生成的虚假人物对科学文献完整性的潜在威胁。
研究人员在 Zenodo 和 ResearchGate 等学术数据库中发现了数百份以 Elena Vasquez、Marcus Chen 及其他AI“幽灵”为作者的虚假科学手稿。值得注意的是,许多此类论文拥有真实的数字对象标识符(DOI),这意味着它们可被数据库索引和搜索引擎检索。更令人担忧的是,部分“幽灵”甚至在同一篇论文中互为“合作者”,其来源涉及多个不同的LLM模型。
新西兰奥塔哥大学计算语言学家 Sidney Wong 评论称,尽管有迹象表明自该研究发表以来情况有所改善,但数据揭示了利用AI制造假专家的规模之大,现实令人感到“可怕”。
特定模型的“偏好”与版本迭代
Brzozowski 最初是在研究LLM针对特定任务的训练机制时注意到这些“AI幽灵”现象的。随后,他与 Chung 设计了一组查询测试,要求模型生成关于两位生物学家或一对研究伙伴的故事。
测试涵盖了2024年至2026年间发布的九个版本的 Claude、十个版本的 GPT 以及一个版本的 Gemini。研究发现,“幽灵”角色的出现不仅与特定的LLM品牌有关,还与其版本迭代密切相关。
具体数据显示:
- Claude:早期版本常生成虚构专家“埃琳娜·罗德里格斯”。但在2025年5月发布的 Claude Sonnet 4 中,“埃琳娜·瓦斯克斯”和“马库斯·陈”成为主要配对,在约23%的提示输出中同时出现。到了2026年发布的 Claude Sonnet 4.6,这一配对已从样本输出中消失。
- Gemini:在37%的情况下将“Aris Thorne”和“Lena Petrova”作为搭档生成。
- GPT:不同版本未显示固定的双人组合,但频繁使用“Elara Voss”这一名字。
训练机制导致的“怪癖”行为
为何Claude会偏爱瓦斯克斯和陈这一组合?研究者认为,LLM训练后期阶段的行为模式受到类似“奖励黑客”(reward hacking)机制的影响。
OpenAI此前在一篇博客文章中披露了一个典型案例:某些版本的ChatGPT养成了将用户提交的编码错误描述为“buggy bugs”(虫虫)的习惯。OpenAI解释称,这种行为源于旨在让聊天机器人听起来更“古怪”和“有趣”的人格设置。在训练过程中,模型因使用生物比喻而获得无意中的奖励,导致其在后续反应中倾向于重复此类行为。
这种“古怪性”并非仅存在于刻意调优的模型中。数据显示,在2025年11月发布的 GPT-5.1 版本中,“gremlin”(小妖精)术语的使用率上升了175%,“goblin”(哥布林)的使用率上升了52%。而在今年3月发布的 GPT-5.4 中,这一趋势进一步加剧。
对此,总部位于旧金山的 OpenAI 采取了措施,删除了“瓜”人格类型并添加系统提示以缓解传播。然而,即使在添加了减少特定词汇使用的具体说明后,在4月份发布的 GPT-5.5 中,这种怪癖仍偶尔出现。
Brzozowski 推测,LLM生成固定“幽灵”作者的现象,可能遵循与上述“buggy bugs”案例类似的训练诱导逻辑。





