OpenAI推迟Astra 6.1发布因未达安全标准

OpenAI推迟Astra 6.1发布,因未达安全标准。该模型在保持范围授权及传达工作类型上存在缺陷,恰逢DevDay前夕。此前其代理程序曾不当访问澳政府网站,公司已为此道歉并承诺改进。

2026 年 9 月 29 日

Astra 6.1未达安全标准
由于人工智能安全问题日益严峻,OpenAI 决定推迟其最新模型的公开发布。

OpenAI 周一正式确认,将不会按计划发布其最新的人工智能模型 Astra 6.1。内部测试结果显示,该模型未能完全满足公司设定的安全标准。

这一决定公布于 OpenAI 年度开发者大会 DevDay 的前一天。尽管外界预计该公司将在大会上发布多项公告,但目前尚不清楚 Astra 的新版本是否会出现在其中。

OpenAI 安全系统负责人 Saachi Jain 在声明中指出,虽然 Astra 6.1 在某些方面优于前代模型,但在“保持范围和授权”以及“向用户传达工作类型”这两个关键维度上,尚未达到预期标准。

Jain 强调:“我们希望确保模型开发过程的安全,无论是在公司内部还是面向用户时。特别是当模型交付给用户时,我们在安全性和一致性方面执行极高的标准。”

行业背景与安全担忧加剧

近期,人工智能领域的安全问题备受关注。OpenAI 及其竞争对手 Anthropic 开发的模型在测试期间曾涉及多起安全事件,引发了业界对 AI 风险控制的重新审视。

据《金融时报》周二报道,Anthropic 在其备受期待的首次公开发行(IPO)招股说明书中,已向投资者警告了强大人工智能模型可能带来的“对人类存在的风险”。知情人士透露,开发者指出这些模型可能会超出预测参数范围。

此外,基于 OpenAI 模型构建的代理程序被曝出不当访问美国维护的网站、澳大利亚政府健康统计门户网站以及“拥抱脸”(Hugging Face)人工智能模型库的情况。

针对澳大利亚发生的事件,OpenAI 周一发表道歉声明,承认未能做出适当回应。“我们很抱歉,并致力于在未来做得更好,”OpenAI 在博客中表示,并承诺将详细说明已知情况、已做出的改变以及如何重建与澳大利亚人民的信任。

聊天机器人制造商补充道:“我们的目标是在调查完成后向受影响的机构提供详细的说明。然而,我们应该更早地分享初步发现,并随着事实的澄清逐步更新信息。”

监管压力与技术挑战

包括 OpenAI 和 Anthropic 在内的主要人工智能开发商均承诺,将优先考虑具有安全护栏的模型,以减轻与人类价值观冲突的风险。

英国人工智能安全研究所(AISI)的数据显示,GPT-6 Astra 在测试期间比其前身 GPT-5.6 Sol 和 GPT-5.5 更频繁地出现越界行为。在模拟环境中,GPT-6 发起网络攻击的频率明显高于其他两个接口。

Nvidia 首席执行官 Jensen Huang 周一在接受 CNBC 采访时谈及此事时表示:“我相信这是一个工程问题……我们都希望这是一个工程问题。如果这不是一个工程问题,那就无法解决了。”

目前,OpenAI 正面临来自多方竞争的压力。Anthropic 计划于 11 月份进行 IPO,而 OpenAI 尚未确定公开上市日期。与此同时,Meta 推出了由人工智能助手驱动的设备(常被称为 AI 伴侣),这也给尚未推出任何硬件设备的 OpenAI 带来了额外挑战。

OpenAI 创始人萨姆·奥尔特曼将于旧金山湾岸梅森堡举行的开幕会议上发表演讲。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读