OpenAI 近日在 GitHub 上公开了 722 份手稿,披露了其模型在数百个主要数学问题上的最新进展。这一举措可能进一步加剧人工智能领域的争议,并引发数学界的关注。

此次发布的结果符合预期。此前 OpenAI 曾表示,其模型已解决“大多数数学领域中 100 多个长期未解决的问题”。作为本次发布的一部分,OpenAI 提供了模型的推理过程、计算估计以及尝试解决问题的相关信息。据该公司介绍,“平均结果”需要使用 ChatGPT Pro 运行约三小时。
OpenAI 称,此次论文发布的准则遵循了其独立的数学和人工智能咨询小组(AGMAI)的建议。通过传统学术渠道快速发布结果,公司旨在透明化展示所用模型名称、提示词及计算成本等细节。
针对本次发布,OpenAI 将结果托管于 GitHub 存储库中,并表示正在探索其他符合委员会指导方针的社区托管替代方案。对于未来的出版物,公司承诺将通过引用、数学阐述和成果展示等方式进一步提升论文质量,以便学界更好地理解。
不过,OpenAI 并未完全采纳董事会的所有建议。公司在发布中未公布具体的计算时间或所使用的提示词。
OpenAI 宣称的关键成果包括四维 Kakeya 假设的解决方案、对关键计算机算法的改进,以及在迈向黎曼假设挑战方面的进展。据《科学美国人》报道,几乎每一篇论文都是在响应单一提示给一个单一人智能代理的过程中生成的。
目前,这些结果仍需经过数学家的评估以确认其实际影响。随着纳维尔-斯托克斯方程相关争议的爆发,科学界仍持怀疑态度。麻省理工学院数学家安德鲁·萨瑟兰(Andrew Sutherland)向《科学美国人》表示:“除非他们发布模型供人们复制结果,否则我认为你应该把任何关于单个代理的单次点击问题的说法视为未经验证。”





