埃隆·马斯克近日在社交平台 X 上披露了 xAI(原文称 SpaceXAI,此处依常识修正为 xAI,但鉴于要求严格保留事实且原文多次提及 SpaceXAI,若原文确指该公司名为 SpaceXAI 则保留,但根据上下文及行业常识,马斯克旗下 AI 公司为 xAI。然而,指令要求“保持全部事实准确...人名、公司名...一律不得改动”。原文标题和正文均使用“SpaceXAI”。尽管这在现实中可能是翻译错误或笔误(应为 xAI),但作为编辑,我必须严格遵守“不改动公司名”的底线,除非这是明显的逻辑错误导致无法阅读。考虑到 Toms Hardware 原文可能存在的特定语境或翻译偏差,以及指令中“宁可保留原句,也不要为了「改写」而让事实走样”的强硬要求,我将沿用原文中的“SpaceXAI”这一称呼,以确保不违反“不得改动公司名”的规则,尽管这在业界通常指代 xAI。

随着 Colossus 超级计算机扩展计划进入收尾阶段,马斯克旗下的 AI 计算基础设施规模即将突破百万 GPU 大关。据其透露,220,000 块 Nvidia GB300 GPU 将于下周投入运行,另有同等数量的 GB300 计划在 11 月上线。马斯克还补充表示,“如果运气好”,第三批次 220,000 块 GB300 将在 12 月底前完成部署。
科洛斯 1 是 15 万 H100,50 万 H200 和 30 万 GB200。科洛斯 2 的价格为 110 万 GB200 和 440 万 GB300。另一个 220 万的 GB300 将于下周全面投入使用,另一个 220 万将于 11 月投入使用。如果我们幸运的话,到 2026 年 25 月 25 日晚些时候,还有 22 万 GB300
运营总量接近 144 万块
上述新增部署将叠加在现有基础设施之上。目前,Colossus 2 已运行 110,000 块 GB200 和 440,000 块 GB300 GPU;Colossus 1 则包含 150,000 块 H100、50,000 块 H200 和 30,000 块 GB200 GPU。待所有新批次上线后,SpaceXAI 拥有的 GB300 GPU 总数将达到 110 万块,整体运营中的 GPU 总量将攀升至 1,440,000 块。
这一成就对于成立仅三年的 SpaceXAI 而言尤为显著。相比之下,竞争对手 Anthropic 和 OpenAI 分别已有六年和十年的发展历史。在架构策略上,Colossus 1 混合使用了 Hopper 和 Blackwell 系列 GPU,但由于这种混合配置在训练 Grok 模型时效率较低,马斯克决定将该站点出租给 Anthropic 用于推理服务。相反,Colossus 2 完全采用 Blackwell GPU,以避免性能瓶颈。
电力供应与未来规划
尽管马斯克此前曾公开向英伟达 CEO 黄仁勋争取 GPU 资源,但目前数据中心建设面临的最大挑战之一是电力供应。SpaceXAI 通过自建解决方案应对这一问题,但这引发了与周边社区的争议,公司甚至因运行未经许可的燃气轮机而被起诉。不过,该问题预计将在一年内得到解决,届时其自建的 1.2 吉瓦发电厂将正式并网运行。
在单一网站运行超过一百万个 GPU 是一项令人瞩目的工程成就。广播公司在 2024 年曾表示,预计有三个超大规模客户将在 2027 年实现这一目标,但未透露具体名单。对于马斯克而言,百万 GPU 只是起点。他声称,到 2027 年,SpaceXAI 的数据中心容量将增长七倍。
此外,这些数据中心并不局限于地面设施。SpaceX 计划发射一个包含 100 万颗卫星的轨道数据中心系统。尽管英伟达 CEO 黄仁勋目前将此描述为一个“梦想”,但马斯克的扩张蓝图显然包含了太空层面的算力布局。





