华为发布Peerium计算架构,可实现百万处理器协同工作

华为9月17日在上海发布AI计算架构Peerium,基于嵌套并行、统一内存寻址与平等互联,支持百万级处理器协同,突破传统主从架构限制。灵衢为其关键互联技术,首代产品Atlas 950超节点已部署,Atlas 960正测试。

9 月 17 日,华为在上海正式推出面向 AI 时代的全新计算架构 Peerium。按照华为的说法,这一架构能够让百万级处理器像一台计算机一样协同工作,以应对不断增长的 AI 算力需求。

Peerium 的技术基础可以归纳为三点:嵌套并行、统一内存寻址和平等互联,三者共同支撑起百万级处理器的强扩展能力。

架构层面,华为提出了 Nested BSP(IT之家注:嵌套批量同步并行,一种将并行计算任务分层递归组织的计算范式),突破了传统图灵范式与冯 · 诺依曼单机架构的限制。

在传统设计中,冯 · 诺依曼体系结构要求计算机按程序顺序执行,运算器、控制器、存储器、输入与输出系统各司其职,主从关系贯穿其中。华为指出,Peerium 架构颠覆的正是这种长期存在的主从架构。

支撑 Peerium 落地的关键互联技术是灵衢。该技术基于一个开放协议,能够以无限扩展的方式联接 CPU、NPU、内存、SSD、网卡和交换机,让计算、存储与网络实现平等互联。

作为该架构的首代产品,Atlas 950 超节点已经进入部署阶段。华为披露,25.6 万卡 Atlas 950 超节点集群正在部署中;基于 NPO 的 Atlas 960 系统则处于测试阶段。

华为轮值董事长徐直军在发布仪式上表示:“AI 时代,华为基于开创的 Peerium 计算架构,持续打造满足客户训练和推理需求的超节点和集群,让算力无处不在,让智能无所不及。”

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读