Anthropic与OpenAI同步发布新模型,迭代加速

Anthropic与OpenAI同步发布新模型,迭代显著加速。尽管此前曾呼吁放缓发展,但两家近期发布间隔缩短至数周。新模型在提升性能的同时大幅降低API价格,其中缓存读取成本降幅最高达60%。

尽管前沿人工智能实验室的开发者们在今年7月曾联名呼吁放慢发展步伐,且Anthropic首席执行官Dario Amodei也在9月中旬重申了这一立场,但主要模型版本的发布节奏并未因此放缓。就在本周二,Anthropic与OpenAI几乎同时推出了新一代模型:前者发布了Claude Opus 5.5,后者则推出了GPT-6 Sol和Luna。

发布周期从季度缩至月度

发布周期显著加速

Amodei在2026年9月12日的在线帖子中明确表示:“我们必须放慢提高人工智能模型能力的速度”,以此回应名为“Pacing the Frontier”的行业倡议。然而仅十天后,Anthropic便正式庆祝了Opus 5.5的上线,并将其描述为“迄今为止测试过的表现最强的模型”。

从时间线上看,Anthropic的新品迭代频率正在急剧提升。Opus 5.5距离Fable 5.1和Mythos 5.1的发布仅间隔21天,距离Opus 5发布也仅39天。整体而言,Anthropic的模型发布节奏已从2025年的大约每季度一次,加速至2026年的几乎每月一次。

OpenAI方面,虽然年初经历了一波密集发布(包括2月和3月的多款模型及4月的GPT-5.5),随后在7月9日推出GPT-5.6时曾出现77天的间隔,但近期节奏再次加快。继2026年9月3日GPT-6 Astra首次亮相后,仅19天后GPT-6 Sol和Luna便紧随其后。

值得注意的是,这两家竞争对手的高频发布背后,似乎有着共同的资本市场考量。Anthropic可能在今年年底前进行首次公开募股(IPO),而OpenAI预计要到2027年才会上市。

性能与成本优化成为焦点

在技术细节上,Anthropic强调Opus 5.5在软件任务上的表现优于前代,支持快速代码迁移并减少了软件加载时间。根据人工分析智能指数(Artificial Analysis Intelligence Index),该模型在代理工作负载中以58分位居首位,超越了GPT-6 Astra。此外,Anthropic指出Opus 5.5在网络安全和生物学领域的能力与Mythos 5.1相当。

价格策略是本次更新的另一大亮点。Anthropic表示,Opus 5.5旨在降低用户成本:“我们的测试显示,在默认设置下,典型工作负载的成本将比Opus 5低40%。”具体参数如下:

  • 输入/输出代币价格:每百万代币分别为4美元和20美元,较Opus 5降低20%。
  • 缓存读取价格:每百万代币0.20美元,较Opus 5大幅降低60%。鉴于缓存读取占代理和编码工作成本的绝大部分,这一降幅对用户极具吸引力。

OpenAI同样通过优化缓存和推理效率来降低成本,并将节省直接传递给客户。OpenAI宣布,GPT-6 Sol和Luna的API价格相比GPT-5.6的促销价降低了50%。人工分析数据显示:

  • GPT-6 Sol (max):每项任务成本1.06美元(GPT-5.6 Sol为1.99美元)。
  • GPT-6 Luna (max):每项任务成本0.07美元(GPT-5.6 Luna为0.18美元)。

在跨应用程序的业务工作流程测试AutomationBench中,OpenAI展示了其价格优势:GPT-6 Sol在xhigh努力级别下的表现优于Claude Opus 5在最大努力级别下的表现,且每任务成本仅为Opus 5的9%。

安全防御机制升级

两家公司均声称新模型在对齐性和安全性方面有所提升。其中,Anthropic引入了一项名为“保存思维”(Save Thinking)的功能,这被视为一种防御性措施,旨在保护其商业利益免受模仿者攻击。该功能最早随Fable 5.1引入,能够阻止API客户端通过编辑Claude的先前上下文来获取模型的内部推理链,从而防止竞争对手通过询问复制模型方法来蒸馏其核心技术。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读