OpenAI发布GPT-6.1 Sol,智能接近旗舰Astra

OpenAI发布GPT-6.1 Sol,智能接近旗舰Astra。新模型事实错误率降至7.7%,已面向Plus及企业版用户开放,但暂未集成至标准聊天界面。

OpenAI 于周二在其开发日活动中发布了 GPT-6.1 Sol。该模型在初代 GPT-6 Sol 推出仅一周后亮相,官方称其智能水平已接近旗舰型号 GPT-6 Astra。

事实错误率降至7.7%

此前,《华尔街日报》报道指出,由于内部测试期间研究人员提出安全顾虑,OpenAI 取消了原计划推出的 GPT-6.1 Astra 版本。

针对复杂任务场景,GPT-6.1 Sol 相较于前代 GPT-6 Sol 实现了显著提升,涵盖编程调试、文档理解及多步骤工作流执行等领域。OpenAI 表示,上述性能表现已逼近 GPT-6 Astra 的水平。

在事实准确性方面,新模型在处理高难度提示时表现更佳。数据显示,在低推理强度设置下,包含事实错误的回答比例从 GPT-6 Sol 的 11.4% 下降至 7.7%。在所有推理配置中,GPT-6.1 Sol 的错误率与 GPT-6 Astra 的差距保持在 1.9% 以内。

此外,GPT-6.1 Sol 展现出更强的自我认知能力,能更坦率地承认自身局限,并在尊重用户意图及安全限制方面更加可靠。在挑战性评估中,该模型在识别故障搜索工具、遵守明确限制以及避免未经授权结果等方面,失败率均低于 GPT-6 Sol。OpenAI 确认,未发现该模型存在绕过自动安全审查机制的情况,这一安全性表现与 GPT-6 Astra 和 GPT-6 Sol 保持一致。

GPT-6.1 Sol 即日起向 ChatGPT Work 和 Codex 平台的所有 Plus、Pro、商业版、企业版及教育版用户开放。需要注意的是,该模型目前尚未集成至标准聊天界面。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读