9 月 9 日,一位前 Anthropic(Claude 背后的开发公司)员工在 X 平台发文指出,人工智能系统的开发者们严肃认为,AI 有可能在十年内导致人类灭绝。与此同时,主要的人工智能公司近期纷纷呼吁加强政府监管、减缓技术发展并强化安全措施。这一表态引发了关于其究竟是公关策略还是真实警告的广泛讨论。

针对“人工智能在本十年末消灭人类的概率是多少”这一问题,分别向 ChatGPT、Claude 和 Gemini 的免费版本进行了提问,以下是各模型的回应:
ChatGPT:5% 至 10%
ChatGPT 给出的概率估计为 5% 到 10%。该模型特别强调,这里指的是真正的人类灭绝,而非严重的经济危机、专制的世界秩序、数百万人死亡或大规模战争等后果。
ChatGPT 进一步分析称,更值得关注的问题在于:未来 10 年内是否会构建出无法被人类可靠理解其行为逻辑的系统?模型认为这种情况发生的可能性远高于人类灭绝的概率。
Claude:风险真实存在,但拒绝具体数字
Claude 不愿承诺一个具体的百分比数字,但表示“风险是真实的,不可忽视的”。Anthropic 旗下的聊天机器人指出,相比人类灭绝,其他负面结果在未来几年内更有可能发生且更具相关性,例如权力集中、人工智能滥用、社会不稳定以及严重但不致死的伤害。
Gemini:综合评估为 10% 至 20%
Gemini 的回答更为保守,它基于人工智能研究领军人物的观点进行评估,而非声称拥有独立意见。尽管立场谨慎,Gemini 给出的概率数值仍高于 ChatGPT。该模型总结认为,若综合悲观主义者、乐观主义者和“务实警告者”的观点,以及当前 AI 安全研究的现状,未来几十年内发生灾难性情景的综合估计通常在 10% 到 20% 之间。
为了提供更清晰的视角,ChatGPT 还列出了其他负面情景的概率估算表:
需要说明的是,聊天机器人本身并不具备主观意见,其回答依赖于训练数据及实时检索的信息。无论外界对“公关论”有何争议,人工智能快速发展带来的潜在灾难性后果不容忽视。根据上述模型的粗略估计,人类在极短时间内面临灭绝威胁的可能性约为 5%。





