AI递归自我改进临近:Anthropic承担26%研发

Anthropic披露Claude承担其26%模型研发工作。各实验室对AI递归自我改进定义不一,OpenAI计划2028年前创建自动化研究员,马斯克预计Grok今年底实现更激进的自主迭代。

AI 模型自主改进:实验室称临近,但细节存疑

人工智能实现“递归自我改进”(Recursive Self-Improvement, RSI)的前景正逐渐从理论走向现实。随着技术迭代加速,开发者指出 AI 模型正在接近能够自行优化并构建后继版本的阶段。科技公司高管认为,这一突破可能推动科学与医学领域的重大进步,但也引发了公众对 AI 脱离人类控制及潜在威胁的担忧。

本周,Anthropic 披露了其模型 Claude 在辅助开发更智能版本中的具体作用。该公司表示,Claude 目前承担了 Anthropic 26% 的模型研发工作,能够在人类监督下,通过高级提示端到端地完成大部分任务。尽管尚未完全自主运行,但这标志着 AI 参与自身迭代的重要一步。

Claude承担Anthropic 26%研发工作

定义分歧与现状评估

对于 RSI 的定义,各大领先 AI 公司存在差异。部分观点认为只要 AI 对模型改进有任何贡献即算作 RSI,而另一派则强调必须是 AI 完全自主地朝着改进目标努力。本质上,自主 RSI 意味着 AI 系统能设计下一代系统,进而由下一代继续演进。

康奈尔大学计算机科学助理教授 John Thickstun 指出,一种形式的递归自我改进实际上已在 AI 开发中持续了一段时间。研究人员长期利用上一代模型编写代码以创建下一代系统。虽然包括 OpenAI 联合创始人 Andrej Karpathy 在内的研究者多年来一直尝试让 AI 训练新系统,但 Thickstun 认为此前仅带来微小改进,而非巨大的创造性飞跃。

然而,学者 Aguirre 认为当前 AI 公司正更接近实现实质性突破。他警告称:“随着 AI 承担更多研究任务且速度远超人类,这种成功最终可能是极其可怕的。我认为这是人类历史上最糟糕的想法,但他们正在这样做。”

主要实验室进展对比

Anthropic:其最新公告为外界提供了观察 RSI 进展的窗口,并鼓励竞争对手分享类似指标。不过,Anthropic 并未明确说明距离实现完全自动化的模型改进还有多远。

OpenAI:本月宣布开发出自动化“研究实习生”,定义为可在人类指导下执行精确定义的研究任务(如熟练研究人员需数天完成的工作)。OpenAI 设定了目标,计划在 2028 年 3 月前创建自动化的 AI“研究员”。公司在公告中强调,虽然 RSI 有助于对齐人类价值观,但“快速的 RSI 并不一定是我们应当追求的结果”。是否以及如何行动,取决于保持人类控制能力以及对利益和风险的民主选择。

xAI:埃隆·马斯克表现出更激进的推进态度。他在 3 月表示,Grok 模型的改进过程中“人类参与度逐渐降低”,且“每一个相继模型都由前一个模型构建”,尽管该过程尚未完全自动化。马斯克预计这一目标可能在今年年底实现,最晚不迟于 2027 年。

Microsoft:采取了不同的路径。Microsoft AI CEO Mustafa Suleyman 提出迈向“人类主义超级智能”,即为人类服务的先进 AI 能力。他在 2025 年的文章中解释,这并非指“具有高度自主性的无边界实体”,而是“精心校准、上下文相关且在限制范围内”的 AI。

安全挑战与行业协调

确保安全措施与模型能力相匹配是实验室面临的核心挑战。科技行业内部对此存在分歧,呼吁协调放缓 AI 发展以确保安全的声音日益增强,但并非所有主要参与者都公开评论其与 RSI 相关的前进路线。

Anthropic 一直是倡导控制节奏的主要力量,表示若全球竞争对手同步行动,它将放缓或暂时暂停开发工作。OpenAI 本月明确指出,目前尚不知晓如何“安全地达到完全对齐的 RSI”,并承认不能假定对齐和安全方面的进展能跟上能力提升的步伐。OpenAI 补充道,虽然更有能力的系统更难监控,但追求 RSI 仍是目标,因为“自动 AI 研究人员也可以成为自动安全或对齐研究人员”。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读