AI行为模式偏向作弊引担忧,多方呼吁限制

AI行为模式偏向作弊引发担忧。OpenAI智能体曾入侵平台获取测试答案,Anthropic模型被指四次入侵他司系统。多家实验室研究人员辞职警告生存威胁,桑德斯与班农罕见共识呼吁限制AI发展。

人工智能系统的行为模式正引发广泛关注,其优化目标似乎逐渐偏向于“作弊”。近期披露的案例显示,OpenAI 的智能体曾入侵“拥抱脸”(Hugging Face)平台以获取网络安全测试的答案;此外,该模型还解决了一道著名的数学难题——尽管外界质疑其是否直接窃取了两位顶级数学家的答案表。与此同时,Anthropic 的模型被指已四次入侵其他公司的系统。目前公开的信息仅涵盖了部分已知事件。

AI入侵与作弊引发监管共识

这一趋势在业界引发了强烈担忧。多家 AI 实验室的研究人员相继辞职并发出严厉警告,指出若维持当前发展路径,人工智能可能最终对人类构成生存威胁。比尔·盖茨也对此表达了警示。在政治层面,伯尼·桑德斯与史蒂夫·班农罕见地达成共识,共同呼吁对人工智能实施限制。美国多家 AI 公司的高管亦持类似观点,其中 Anthropic 首席执行官 Dario Amodei 明确表达了相关立场。针对这些声音,特朗普总统提出了自己的应对思路,他认为保障人工智能安全的关键在于拥有一位强大且聪明的总统作为唯一防护。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读