SpaceXAI 年内新增 66 万 AI GPU,总运力量近 144 万块
距离马斯克宣布将 Colossus 超级计算机扩容至百万 GPU 的目标仅过去近两年,这一终点现已触手可及。这位亿万富翁在 X 上表示,下周将有 22 万块 Nvidia GB300 GPU 投入运行,11 月还将再上线 22 万块。他还补充道,如果运气好,12 月底还有 22 万块将投入使用。
Colossus 1 配备 15 万块 H100、5 万块 H200 和 3 万块 GB200。Colossus 2 则拥有 11 万块 GB200 和 44 万块 GB300。下周另有 22 万块 GB300 将全面上线,11 月再增加 22 万块。如果一切顺利,12 月底还将有 22 万块 GB300 就位。2026 年 9 月 25 日
这些数据将叠加在 Colossus 2 现存的 11 万块 GB200 和 44 万块 GB300 之上,以及 Colossus 1 的 15 万块 H100、5 万块 H200 和 3 万块 GB200。届时,SpaceXAI 的 GB300 GPU 总数将达到 110 万块,整体在役 GPU 总量将升至 144 万块。考虑到该公司比竞争对手晚了好几年——SpaceXAI 成立仅三年,而 Anthropic 和 OpenAI 分别为六年和十年——这堪称巨大成就。值得注意的是,Colossus 1 混合使用了 Hopper 和 Blackwell 架构的 GPU,在训练 Grok 时效率较低,因此马斯克选择将其出租给 Anthropic 专门用于推理任务。相比之下,Colossus 2 仅使用 Blackwell GPU,避免了任何性能瓶颈。
虽然埃隆·马斯克[5]曾恳求英伟达 CEO 黄仁石提供 GPU,但目前获取这些硬件并非最棘手的问题。当前数据中心扩建面临的最大挑战是电力供应,而 SpaceXAI 通过自备电源解决了这一难题。不过,这也引发了周边社区的诸多争议,最终导致[5][5]该公司因擅自运行燃气轮机而遭到诉讼。该公司已[5]承诺移除这些设备,但过程将耗时一年,直至其自建的 1.2 GW 发电厂投入运营。
在单一站点运行上百万块 GPU 是个了不起的成就,但 SpaceXAI 并不是唯一朝着这个目标努力的公司。Broadcom 曾在 2024 年表示,旗下有三家超大规模客户正计划在 2027 年前实现这一目标,但并未透露具体是哪几家。而对马斯克来说,百万 GPU 只是起点。他表示 SpaceXAI 将在 2027 年前把数据中心容量扩大七倍,甚至还有意在 2030 年前部署5000 万块 H100 等效 GPU。这些数据中心也不会只建在地面——SpaceX 计划发射由一百万颗卫星组成的轨道数据中心系统,尽管 Jensen Huang 认为这在现阶段还是个"梦"。
欢迎在Google News 上关注 Tom's Hardware,或将我们设为首选来源,即可在信息流中获取我们最新的新闻、分析与评测。