联合国与Google合作重构全球统计数据库

联合国与Google合作推出“联合国系统数据共享平台”,基于Data Commons取代UNData,支持自然语言查询和MCP协议,使AI智能体可直接调用多机构权威统计数据,以应对AI统计问答准确率低及用户经AI获取数据增长的趋势。

联合国近日宣布与Google达成合作,着手改造其全球统计数据体系,目标是让这些数据能够被人工智能系统更便捷地访问和调用。这一项目既面向人类用户的数据查询需求,也被视为为正在到来的AI智能体时代铺设数据基础设施。

双方此次推出的新平台名为"联合国系统数据共享平台(UN System Data Commons)",基于Google开源的Data Commons技术构建。用户可以通过自然语言直接查询多个联合国机构的统计信息,不再需要像过去那样在传统数据库界面中逐层检索和筛选。

该平台将取代现有的UNData门户。旧系统主要依靠关键词搜索和数据库浏览,新平台则针对人工智能工具和自然语言交互场景做了优化。今后用户可以用日常提问的方式,查询全球发展、人口、教育、健康、经济等领域的数据。

值得关注的是,新平台支持近期受到人工智能行业广泛关注的模型上下文协议(MCP)。该技术标准能够让AI模型直接对接外部数据源,AI智能体在执行分析、研究和查询任务时,可以直接调用联合国官方统计数据,而不必依赖不稳定或未经核实的信息渠道。

联合国推进这一项目,背后有多项研究显示主流AI模型在处理权威统计数据时仍存在明显缺陷。

联合国儿童基金会近期完成的一项测试表明,OpenAI、Anthropic、Google等公司的大语言模型在回答全球发展指标问题时表现欠佳。测试覆盖了超过13.3万个回答样本,六款主流大语言模型的平均准确率仅为21.2%。

研究人员指出,约六成回答甚至无法给出有效数字。不少模型习惯用模糊措辞绕开问题,即便给出了数字,同一问题在不同时间重复提问时,得到的答案也经常发生变化。

参与测试的模型包括GPT-4o、GPT-4o-mini、Claude Sonnet 4.5、Claude Haiku 4.5、Gemini 2.5 Flash和Gemini 2.0 Flash。研究团队认为,这说明当前人工智能系统在调用全球发展数据方面仍面临严峻的可靠性挑战。

与此同时,联合国儿童基金会还注意到另一个趋势:越来越多用户开始通过人工智能工具而不是传统搜索引擎来获取统计数据。

相关数据显示,今年以来,经ChatGPT等人工智能工具跳转至联合国儿童基金会数据网站的访问量同比增长67%。目前来自AI助手的访问已占该网站总流量约十分之一。考虑到该平台每月访问量超过600万人次,这一变化反映出用户信息获取方式正在快速转变。

正因如此,联合国认识到单纯发布数据已经不够。要让未来的人工智能系统准确引用权威统计数据,就必须主动赋予这些数据机器可读、AI可访问、智能体可调用的能力。

目前共有26个联合国机构承诺接入新平台,其中接近20个机构的数据已在平台上线时开放。随着更多机构陆续接入,平台预计将逐步汇聚联合国体系内覆盖经济、社会、环境、教育、健康和可持续发展等领域的大规模官方统计资源。

联合国表示,希望通过该计划为全球研究人员、政策制定者、企业和普通公众提供更可靠的数据支撑,同时确保未来越来越多依赖AI完成分析和决策的系统建立在权威事实之上,而非不稳定或错误的信息来源。

随着人工智能逐渐成为人们获取知识和查询信息的重要入口,联合国与Google的这次合作,也被视为国际组织首次系统性为"AI智能体时代"建设官方数据基础设施的尝试。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读