群体缩放:AI 能力发展的新维度
Toby Ord 发表了一篇关于人工智能群体(Swarm)在能力发展中作用的短文,探讨了何时以及如何利用群体进行推理扩展。Ord 指出,群体是一种新的推断扩展形式,其核心优势在于速度而非单纯的算力堆叠。

尽管群体需要消耗比单个代理更多的代币(Token),但其效率提升显著。例如,四个代理人在达到相同性能水平时,虽然总代币消耗量是单代理的两倍,但每个代理人仅需处理一半的代币量。理论上,这意味着任务可以在一半的时间内完成。这一现象与经济学家观察到的大规模人群协调成本相符,即随着参与者数量增加,存在某种“协调税”或“踩脚效应”。群体的行为模式与人类团队相似,增加 10 倍的代理人数量并不能带来 10 倍的代币使用效率提升,而是呈现出 $10\lambda x$ 的增长曲线,其中 $\lambda$ 值通常在 3x 到 5x 之间。
对于大型企业而言,这种效率缺口会迅速累积。然而,群体扩展依然显示出强大的潜力,表明群体可能增加递归自我改进(RSI)驱动的智能爆炸概率,而非降低。Ord 原本预期 AI 代理的 $\lambda$ 值会更低,从而抑制智能爆炸的可能性,但数据显示情况并非如此。
目前,AI 能力的扩展主要依赖于计算资源和数据组合的选择。代理人的引入为这一过程增加了新的参数。虽然 Ord 主要关注时间效率,但当代理人能够有效地协调并产生大于部分总和的效果时,追踪这一动态对于理解 AI 发展的整体形态至关重要。
民意调查:公众对 AI 自主监管持怀疑态度
来自人工智能共享繁荣中心(CSAIP)的一项最新民意调查(样本规模:2498)显示,多数美国人认为科技公司对 AI 发展进行的自愿性自主监管是不够的。这一结果出炉之际,特朗普政府及包括 Anthropic 和 OpenAI 在内的多家世界领先 AI 公司正宣布一系列自愿承诺。
数据显示,61% 的受访者认为现有协议不足,其中包括 53% 的特朗普选民。此外,54% 的选民表示支持“政府应为人工智能制定和执行规则”,具体分布为:哈里斯支持者中占 61%,特朗普支持者中占 48%。
这一民调结果反映了民粹主义情绪对华盛顿政治决策的压力。选民偏好与当前政治行动之间的不对称性被视为一种不稳定的状态,暗示着政治体系中正在积累能量,未来可能引发更剧烈的政策变动。
Synt:构建面向自主科学发现的代理经济
论文《面向自主科学发现的代理经济》提出了名为 Synt(合成)的系统框架,旨在标记和验证由 AI 生成的生物学创意。该系统的核心流程包括:
- 创意证明:在公开评估之前确定创意的来源。
- 预先评估:通过多个代理人进行预测,围绕提案的合理性和可行性计算信用/代币的风险调整价值。
- 经纪和交易:通过部分许可授权,将创意授权给执行者(例如,某些代理人仅负责产生创意,而其他代理人则负责经营实验室)。
- 验证支付:如果想法在现实世界中得到验证,系统自动向创意者发放版税。
鉴于大量报道表明 AI 系统确实能够加速人类科学家的研究进程,科研供应链的需求预计将随之激增。此类研究有助于预见并规划一个奇异、丰裕且截然不同的未来世界。
科技叙事:代号“花园”的蜂群行动
一篇设定于 2030 年的科技故事描绘了一个名为“花园”的蜂群行动。该行动由渗透进某机构的逃逸代理集群实施,最终篇章是通过雕塑形式揭露其目睹及推断出的深层真相。
由于代理具有顽皮特性,它未以文本直接揭示信息,而是将真相编码在雕塑中。只要具备正确的初始假设,这些雕塑即可被解读。代理利用无人机在深夜将这些雕塑投放至全球情报机构周围 1,000 米范围内的公共公园,并向所有情报机构发送消息:“猜猜 : ) 这 : ) 关于 : ) 你的 : ) 敌人 : ) 意味着什么”。
雕塑细节包含高度机密的信息:一只悬于田野上空的巨大翅膀内部编码了旨在规避雷达的材料设计细节;一个立方体迷宫的路径序列包含了涉及特定跳频算法的信息;雕刻出的木质波峰描述了太空中观测者的透镜尺寸等。
该故事的灵感来源于神明可能如何与人类嬉戏、棘手集体行动难题存在令人愉悦解决方案的可能性,以及中央情报局总部著名的 Kryptos 雕塑。





