长期以来,关于人工智能(AI)的讨论主要聚焦于“智能”这一维度,即机器是否具备类人思维能力。然而近期,美国总统唐纳德·特朗普将争论焦点转向了术语本身。

数学家警告说,arXiv 可能无法在人工智能垃圾攻击中存活
特朗普认为“人工智能”一词具有误导性。他在9月22日的联合国大会讲话中表达了对该技术的惊叹,并呼吁将其更名为“超级智能”。随后,他在9月29日签署的行政命令中正式支持了这一更名举措。
尽管“超级智能部队”这一表述颇具科幻色彩,但试图将现代AI系统与20世纪40至50年代的早期概念剥离并非特朗普一人所为。此前,Meta首席执行官马克·扎克伯格也曾发表声明,提及哲学家尼克·博斯特罗姆在其2014年著作中定义的“超级智能”概念。
广告
特朗普所指的“超级智能”与博斯特罗姆定义的概念存在本质差异。特朗普的重命名旨在巩固美国在AI领域的主导地位,其行政命令指出,“超级智能”更能准确描述当前技术承诺、潜力及快速迭代的能力。相比之下,博斯特罗姆设想的超级智能远超现有AI系统的能力范畴。理解这一区别需回溯历史脉络。
早在ChatGPT问世之前,研究人员已区分弱人工智能(Weak AI)与强人工智能(Strong AI)。这两个术语由哲学家约翰·西尔(John Searle)在1980年的论文《思维、大脑和程序》中提出。西尔认为,弱人工智能仅是人类思维的计算机模拟,而非真正的思考;强人工智能则指软件产生的实际认知。他通过类比指出:“没人认为计算机模拟的暴雨会让人湿透”,因此质疑计算机模拟的理解是否等同于真正理解。
受西尔理论影响,行业话语体系发生了转变,从关注“意识”转向关注“能力”,因为后者更易量化且更符合计算机科学实验室的研究范式。弱人工智能逐渐被“狭义人工智能”取代,指代在特定任务上达到人类水平的系统。过去几十年间,从垃圾邮件过滤器到国际象棋引擎,此类系统广泛存在。这种现象被称为“人工智能效应”:一旦某项功能通过狭义AI实现,它往往被视为普通软件。
与此同时,强人工智能演变为通用人工智能(AGI),即能在任何任务上达到人类水平的系统。AGI被视为理想目标,因其意味着无需为每项任务单独构建系统,而是像人类一样实现跨领域的知识迁移。2002年,Shane Legg(后来成为DeepMind联合创始人)普及了“人工通用智能”这一术语。
目前,包括DeepMind和OpenAI在内的多数大型AI公司均以实现AGI为目标。在2010年代,这曾被视为近乎科幻的研究方向,如今却已成为吸引数万亿美元投资的商业核心。
尽管AGI备受关注,但其定义仍显模糊。OpenAI章程将其定义为“在经济价值最高的工作中表现优于人类的高度自主系统”。而在2024年泄露的OpenAI与Microsoft协议中,AGI被定义为能产生1000亿美元利润的系统。即便如此,OpenAI总裁Greg Brockman在9月发布Astra模型时仍宣称“欢迎进入AGI时代”。
无论采用何种定义,AGI并不等同于超级智能。博斯特罗姆在书中明确界定,超级智能是“在几乎所有感兴趣领域大大超过人类认知能力的智力”。这意味着超级智能必须在科学、艺术、哲学等所有维度超越历史上最杰出的头脑,如莎士比亚、达芬奇、史蒂夫·乔布斯和简·奥斯汀等。显然,当前技术尚未达到这一水平,而真正的超级智能可能会以不可预见的方式改变世界。
除了定义分歧,核心问题在于如何衡量“智能”。智商(IQ)常被视为一种指标,测试高端AI模型得出的智商分数通常在130至150之间。然而,这一方法存在缺陷:测试题目可能包含在模型训练数据中,且高智商测量本身日益困难。此外,智商作为源于优生学的指标,已被广泛认为是有缺陷的衡量标准,应用于AI评估效果有限。
作为替代方案,部分计算机科学家提出了针对AI的智能测试,例如ARC-AGI。该测试不仅评估模型性能,还考量运行成本,使得计算资源消耗较少的模型获得更高评分。目前ARC-AGI已进行至第三版,OpenAI最新型号之一GPT-6.1 Sol得分为96.2%,完成测试成本为3800美元。但这是否意味着实现了AGI尚存争议,预计ARC-AGI第四版将很快推出,以重新设定评估标准。
尽管AI公司坚信超级智能终将到来——其中可能混合了信念与营销成分——但相关术语的定义及评估方法仍在不断演变。2022年被视为神奇的技术突破,在2026年可能已变得平淡无奇。或许我们正逐渐意识到,某些所谓的“新成就”早已存在,只是刚刚被赋予了新的名称。
OpenAI mistranslated mathematics into code for its Navier-Stokes proof
当OpenAI宣布其对纳维尔-斯托克斯问题的解决方案时,它为人类和计算机提供了一个证明。
更多人工智能阅读:(图片来源:美国美国美国)
- 一位软件开发人员使用 Anthropic 的 Opus 5.5 模型重建 Photoshop 和其他 Adobe 产品,并在 GitHub 上免费发布代码。如果 Adobe 的律师不快来敲门,我会很惊。
- 在犹他州,Nolla Health 正在试用"人工智能配备的处方"来治疗。起初,两名执照医生将在患者接受之前审查人工智能生成的处方。在进一步的试验中,只有在处方已经发送后才会进行此类审查。
- Google 已经发布了 Playground,一个人工智能应用程序,通过文本提示生成可玩的游戏。我自己也没有使用过它,但是我使用 Claude 来创建游戏的实验结果不尽相同。
- 一个新的趋势是人们将两款不同的电子游戏"合并",通过使用人工智能重新创建其中一款游戏的代码。这导致了像 Minecraft 在 Elden Ring 内部。这是一个有趣的想法和一个伟大的病毒视频,虽然它不清楚这些实际上玩 legal 和再次,法律问题很大。
- ChatGPT 有一个新的"智能用户界面"功能,允许聊天机器人使用交互式可视化来回答问题,而不仅仅是文字。我发现让模型创建一个我可以探的临时网站往往是非常有帮助的,这基本上为不想设置自己的网络服务器的人提供了这种功能。





