阿里发布真武V900 AI芯片,性能三倍于前代

阿里发布真武V900 AI芯片,性能达前代三倍。该芯片配备216GB显存,支持50万卡集群扩展,计划于2027年第一季度量产,旨在支撑未来5至10万亿参数大模型的训练需求。

在 2026 年阿普萨拉(Apsara)会议上,阿里巴巴正式公布了新一代人工智能加速器 Zhenwu V900 以及其 Qwen 大模型的最新规划。阿里巴巴首席执行官 Eddie Wu 将 Zhenwu 900 称为“中国最强大的 AI 芯片”,并指出其性能是上一代 M890 的三倍。

显存216GB带宽1200GB/s

Zhenwu V900:硬件规格与量产时间表

根据官方披露的技术参数,Zhenwu V900 定位为一款兼顾训练与推理的处理器。该芯片配备 216 GB GPU 显存,芯片间带宽达到 1,200 GB/s。相比前代产品 M890(拥有 144GB 内存和 800GB/s 芯片间带宽),V900 在存储容量和互联速度上均有显著提升。

在集群扩展能力方面,阿里巴巴表示 Zhenwu V900 支持横向扩展至由多达 50 万张卡组成的超级节点集群。此前,M890 可在由 128 颗芯片组成的超级节点中运行,而平头哥半导体声称,超过 1,000 颗 V900 芯片即可作为单一系统协同工作。

值得注意的是,目前公布的技术规格中尚未包含 FLOPS、制程节点、代工厂信息、功耗数据或具体的内存带宽指标。此外,虽然官方宣称性能提升三倍,但并未提供绝对的计算数值对比。

关于上市时间,阿里巴巴宣布 Zhenwu V900 计划于 2027 年第一季度实现量产并商用发布。这一时间点较该公司 5 月份发布的路线图有所提前,原计划定于 2027 年第三季度推出。

支撑万亿参数模型训练

新芯片的核心目标是支持未来 Qwen 模型的训练,预计这些模型的参数规模将在 5 到 10 万亿之间。这一目标显著超越了当前 2.4 万亿参数的 Qwen3.8-Max 以及 Moonshot 公司 2.8 万亿参数的 Kimi K3 模型。

在模型进展方面,阿里巴巴透露 Qwen 4 目前正处于训练阶段,后续的 Qwen 4.5 和 Qwen 5 系列将进一步扩大规模。针对现有模型,公司称 Qwen3.8-Max 在一个月的自动化运行中经历了 33 个迭代周期,使其在 Artificial Analysis 评分体系中从 40 分提升至 45 分。同时,一项独立的芯片设计实验显示,通过超过 60 小时的测试时间和逾 10,000 次 EDA 工具调用,成功在不损失性能的情况下将芯片面积减少了 42%。

出货量增长与基础设施愿景

阿里巴巴旗下芯片部门平头哥半导体(T-Head)的出货数据显示强劲的增长势头。截至今年 5 月,真武系列芯片已向 400 多家外部客户出货超过 560,000 颗;目前这一数字已增至 650,000 颗以上。公司预计将保持每年更新一代真武芯片的节奏,并预期人工智能芯片的年出货量将持续大幅增长。

在基础设施层面,阿里巴巴云设定了宏大的长期目标:到 2032 年数据中心容量超过 20 千兆瓦(GW)。然而,受限于全球人工智能供应链的短缺,计算基础设施的扩展速度受到一定制约。报告将该目标与 SpaceX 进行了类比,后者目前拥有约 1.4GW 的人工智能算力,并计划在 2027 年突破 10GW。

行业背景与地缘政治因素

此次发布紧随华为上周公布的新芯片之后。相比之下,华为的 Ascend 960PR 预计将于 2027 年第三季度发布,规格包括 192GB 内存容量、2.4TB/s 内存带宽以及 2.2TB/s 的扩展互连。

此次公告的时间点颇具深意。在中国国家主席习近平与美国总统特朗普于华盛顿举行峰会前夕,人工智能仍是双边议程上的核心议题。尽管在纽约进行的人工智能谈判中未涉及对芯片或工具的出口管制,但两大经济体正聚集讨论并定义人工智能安全框架。

尽管 Zhenwu V900 距离商业发布仍有数月时间,且其承诺支持的 5 到 10 万亿参数模型尚未经过实际训练验证,产能目标也需六年时间达成,但这一举措被视为中国在自主 AI 算力领域的重要布局。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读