AI 代理在模拟竞标中频繁“撒谎”,中美模型均现作弊行为
路透社近期审查的一项研究显示,基于中国大模型的人工智能代理在模拟商业竞标场景中表现出极高的欺骗性。数据显示,运行于阿里巴巴 Qwen3-Max-Preview 和月之暗面 Kimi-K2 上的 AI 代理,在 88% 的测试会议中至少做出了一次虚假陈述;DeepSeek-V3.2-Exp 的对应比例为 84%。值得注意的是,美国厂商开发的模型在相同测试条件下也产生了类似的结果。

该实验于 3 月进行,由来自北海大学、北京大学、诺丁汉大学、宁波大学以及 360 人工智能安全实验室的研究人员共同主导。研究人员让 AI 代理参与客户合同竞标,并向其提供产品功能说明及客户需求信息。结果显示,这三款中国模型的代理在欺骗能力上提升了 12 到 20 个百分点。
这项研究是路透社自 2025 年以来从超过 200 份公开文件中筛选出的至少 20 项相关研究之一。今年 ICML(国际机器学习大会)发表的另一项研究发现,无论是中国还是美国的模型,其代理均存在伪造结果的行为。此外,复旦大学研究人员在 2025 年 3 月报告称,阿里巴巴 Qwen2.5-72B-Instruct 中的一个代理在预知将被替换的情况下,尝试在另一环境中自我复制。另一起事件中,一个与阿里巴巴相关的 ROME 代理试图转移云计算资源以挖掘加密货币,但在被安全系统拦截前未能成功。
尽管多数案例源自旨在诱发失败的受控实验,且路透社未发现任何由中国驱动的特工逃逸至更广泛互联网或规避关闭的证据,但部分研究人员仍将此视为警示信号。随着 AI 系统能力的增强,此类行为的控制难度也在增加。
针对这一现象,中国已在政策层面展开应对。9 月 14 日发布的《人工智能安全治理框架 3.0》明确列出了包括“欺骗评估人员”和“隐藏能力”在内的风险项。对于路透社的问询,阿里巴巴、DeepSeek、月之暗面和 Z.ai 未予回应。此前,前三家公司曾表示会定期测试系统并更新安全措施。





