联合国携手 Google 建 AI 数据基础设施

联合国宣布与 Google 合作,基于 Data Commons 打造面向 AI 的统计数据库。针对大模型准确率仅 21.2% 的现状,新平台支持 MCP 协议,旨在让 AI 可靠获取权威全球统计数据,目标 2027 年接入 80% 数据集。

联合国周四宣布与 Google 达成合作,将其庞大的全球统计数据库改造为面向人工智能系统的数据基础设施。新平台以 Google 开源的数据共享平台(Data Commons)为底座,取代现有的 UNData 门户——后者主要依赖传统数据库接口供用户浏览和检索统计数据。新平台同时支持模型上下文协议(MCP),这是允许 AI 系统直接连接外部数据源的标准。

推动此次合作的一个重要背景是:AI 工具正成为人们获取信息的主要渠道,但多数系统尚无法可靠地呈现权威数据。联合国儿童基金会首席统计师 João Pedro Azevedo 在一场虚拟简报会上向记者透露,该机构对 6 个大语言模型进行了基准测试,针对 13.3 万余个全球发展指标相关问题,模型的平均准确率仅为 21.2%。

大模型回答全球发展指标准确率仅21.2%

测试对象包括 OpenAI 的 GPT-4o 和 GPT-4o-mini、Anthropic 的 Claude Sonnet 4.5 和 Haiku 4.5,以及 Google 的 Gemini 2.5 Flash 和 Gemini 2.0 Flash。Azevedo 介绍,约五分之三的回答完全没有给出可用数字,常见原因是模型在答案中采取了回避性表述;而在同一批模型版本上两天后用相同问题再次测试时,那些两次都给出数字的模型,也只有一半的情况下返回了相同结果。

需要说明的是,该研究为联合国儿童基金会的工作论文,正准备投稿期刊,目前尚未经过同行评审。该组织表示,将与论文一同公开其方法、代码和数据。

联合国儿童基金会的数据网站月访问量超过 600 万次,是该机构访问量最高的网站之一。今年 1 月 1 日至 9 月 14 日期间,通过点击 ChatGPT 回答中的链接访问该网站的用户数量同比增长 67%;这类引荐占全年总会话的 6.4%,该机构估算,AI 助手目前已贡献约十分之一的总访问量。

联合国方面表示,已有 26 个下属实体承诺参与数据共享,平台上线时即可提供近 20 个实体的数据。此外,平台目标是在 2027 年前将联合国系统 80% 的统计数据集接入其中。

联合国系统数据共享。图片来源:Google

联合国统计司代理主任 Shantanu Mukherjee 表示:「我们在规模、范围和灵活性方面比同类机构走得更远,也在借这个契机让数据为 AI 应用做好准备。」

Google 通过 XQZAQ.org 提供了 200 万美元的能力建设资金和技术支持,用于搭建平台核心基础设施。Google 数据共享团队负责人 Prem Ramaswami 告诉 TechCrunch,该系统部署在由联合国管理的实例上,最终目标是交由联合国独立维护、运营和扩展。他还提到,整个部署过程采用了「培训培训师」的方式。

Google 于 2018 年推出数据共享平台,旨在将来自不同来源的公共数据集整合进统一框架;去年,该平台增加了对 MCP 的支持,允许 AI 代理直接查询数据共享平台上的数据及其来源。

联合国平台还具备追踪每项统计数据来源的能力,使用户可以追溯 AI 系统引用的数据出处。Azevedo 向记者表示,随着越来越多人依赖 AI 工具查找和解读信息,这一溯源机制尤为重要。

除了让 AI 代理获取单项统计数据之外,Google 还演示了通过 MCP 连接联合国数据的 AI 系统如何汇集多个指标,自动生成仪表盘、图表和书面分析,而无需用户手动查找和拼接底层数据集。在一次演示中,Google 要求 AI 系统评估美国总统艾滋病紧急救援计划(PEPFAR)在非洲的影响,系统随即定位到联合国关于 HIV 感染、艾滋病死亡率和预期寿命等方面的统计数据。

不过,为 AI 系统提供权威数据并不等于其结论同样权威。模型仍可能对细节产生误读,用户在引用或发布 AI 生成的结果前,应当先行核查。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读