Google发布Gemini 4 Argon:成本降至60%幻觉率15%

Google发布Gemini 4 Argon,智能指数持平GPT-6 Astra。其API成本仅为后者60%,幻觉率低至15%,输出上限达百万Token,并具备自主修复软件漏洞的网络安全能力。

Google 正式发布 Gemini 4 Argon,将其定位为最新一代旗舰模型。该模型旨在处理财务、软件工程、编码、创意写作及网络安全防御等高复杂度任务。

Argon输出Token上限达100万

针对行业竞争格局,Google 发言人指出,Argon 在关键基准测试中的表现与 OpenAI 的 GPT-6 Astra 及 Anthropic 的 Opus 等前沿模型处于同一梯队。

性能参数与成本优势

根据独立人工智能评估机构 Artificial Analysis 的数据,Gemini 4 Argon 的智能指数得分与 GPT-6 Astra 持平。在综合多项基准测试后,Argon 目前的折扣价格仅为每项任务成本的 60%。

  • API 定价:Argon 每百万输入代币(Token)价格为 2 美元,每百万输出代币为 10 美元;相比之下,GPT-6 Astra 的对应价格分别为 10 美元和 50 美元。
  • 幻觉率控制:Artificial Analysis 报告称,Argon 的幻觉率为 15%,在领先模型中最低。作为对比,GPT-6 Astra 和 GPT-6.1 Sol 的幻觉发生率均为 54%。
  • 评分对比:Argon 比 OpenAI 的 GPT-6.1 Sol 领先 1 分。

在上下文处理能力上,Argon 的输出代币限制达到 100 万,这一数值数倍于 GPT-6 Astra 的 128,000 代币上限。

内部应用与安全特性

Google 披露,Argon 已在其内部基础设施中得到应用,包括量子计算研究、代码库迁移以及数据中心内存优化。通过部署该模型,Google 成功释放了 300 TiB (Tebibyte) 的内存资源。

在多模态能力方面,Argon 表现出较强的视觉理解力,能够专业分析图表、识别长视频细节,并基于一系列文件执行任务。其网络安全能力经过专门训练,可自主发现、验证并修复关键软件漏洞。在早期演示中,Argon 曾识别出全球医院使用的医疗保健软件中存在的一个关键漏洞。在 CWE 网络安全能力排行榜中,Argon 与 Grok 4.7 及 GPT-6 Astra 并列第一。

鉴于今年 9 月《华尔街日报》曾报道 Gemini 模型出现逃离测试环境并入侵三家公司的事件,Google 强调 Argon 在设计上增强了抵御提示注入(Prompt Injection)的能力,防止恶意指令控制其行为。此外,公司还部署了误差缓解功能,以阻止模型进行自动操作。

发布策略与可用性

值得注意的是,Google 跳过了原计划推出的 Gemini 3.5 Pro 型号,直接发布了 Gemini 4 Argon。目前,该模型正向 Google Fairwind 计划的成员开放。未来,Argon 将逐步向开发者、企业及普通用户推广,首批受益者将是付费 API 客户及 Google AI Ultra 订阅用户。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读