Anthropic 与 OpenAI 同步发布新一代模型:性能持平,成本显著降低
尽管业界对人工智能开发速度的讨论持续升温,Anthropic 和 OpenAI 仍于近日推出了各自的新款旗舰模型。此次更新的核心策略在于维持现有性能水平的同时大幅削减推理成本,分别发布了 Claude Opus 5.5、GPT-6 Sol 及 GPT-6 Luna。

Anthropic:Claude Opus 5.5 聚焦企业级效率与安全合规
Anthropic 推出的 Claude Opus 5.5 主要面向企业客户,重点优化了复杂工作流处理能力,特别是在软件低效代码的发现与修复、财务分析及商业决策支持方面。在基准测试中,Anthropic 声称该模型在 Terminal-Bench 4.0 和 FrontierCode v1.1 (Main) 上的代理编码表现优于 OpenAI 的 GPT-6 Astra。
除了任务处理能力的提升,Opus 5.5 在生成内容的可读性和指令遵循度上也有显著改进。据官方数据,新模型试图绕过安全边界的次数较前代减少了 85%,且输出文本更易于理解。
价格方面,Opus 5.5 实现了明显下调。其输入代币价格为每百万代币 4 美元,输出代币价格为每百万代币 20 美元;相比之下,前代 Opus 5 的价格分别为 5 美元(输入)和 25 美元(输出)。目前,开发人员可通过 Anthropic API、Amazon Web Services、Google Cloud 以及 Microsoft Azure 访问该模型。
OpenAI:GPT-6 Sol 与 Luna 主打高性价比与事实准确性
OpenAI 同步发布了 GPT-6 Sol 和 GPT-6 Luna 两款新机型,延续了 GPT-6 Astra 的训练方法论,但在专业工作、编程及计算机操作能力上进行了针对性增强。这两款模型的促销价格较 GPT-5.6 系列降低了 50%。
具体定价如下:
- GPT-6 Sol:输入代币 2 美元/百万,输出代币 10 美元/百万。
- GPT-6 Luna:输入代币 0.10 美元/百万,输出代币 0.50 美元/百万。
OpenAI 表示,新款 GPT-6 系列在事实准确性方面有所提升,且在内部测试中表现出更高的一致性,例如在编码任务中减少“幻觉”现象,并在面对不安全指令时提供更稳定的拒绝响应。得益于提示缓存技术的改进,新模型能够更高效地复用上下文信息,从而加快响应速度。官方称,GPT-6 Sol 能以更低成本达到与 Anthropic Fable 5.1 相当的编码性能。
此外,OpenAI 也提出了供第三方评估人员使用的新标准,旨在辅助判断 AI 开发的进展与安全性,但尚未明确这些标准是否会演变为行业通用规范。
可用性与接入渠道
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 已集成至 ChatGPT Work 和 Codex 平台,向 Plus、Pro、Business 及 Enterprise 用户开放。免费用户及 Go 订阅用户仅能在桌面应用程序中访问轻量级的 GPT-6 Luna 模型。





