馬斯克在 X 上披露,SpaceXAI 的 Colossus 2 資料中心將於下週投運 22 萬塊輝達 GB300 GPU,11 月再上線 22 萬塊,若進展順利,12 月底前還會有第三批 22 萬塊到位。這意味著今年新增 66 萬塊 GB300,疊加現有在運裝置後,SpaceXAI 的 GB300 總數將達到 110 萬塊,全部在運 GPU 總量升至 144 萬塊。

這一數字兌現了馬斯克約兩年前提出的目標——把 Colossus 超算擴充套件到百萬 GPU 以上。按他給出的構成,Colossus 1 目前執行 15 萬塊 H100、5 萬塊 H200 和 3 萬塊 GB200;Colossus 2 則執行 11 萬塊 GB200 和 44 萬塊 GB300。兩處站點合計,構成了上述 144 萬塊的在運規模。

值得注意的是,Colossus 1 混用 Hopper 與 Blackwell 兩代 GPU,對訓練 Grok 效率不高,因此馬斯克將其租給 Anthropic 用於推理;Colossus 2 則全部採用 Blackwell 架構,以避免訓練環節出現瓶頸。這種分工在算力排程上頗具代表性:老一代叢集轉向推理,新一代叢集專注訓練,反映出大模型廠商對異構算力按任務型別分層使用的思路。

從競爭節奏看,SpaceXAI 成立僅三年,而 Anthropic 與 OpenAI 分別已有六年和十年曆史。以更短的時間堆出百萬級 GPU 叢集,是這條訊息最受關注之處。不過,拿到 GPU 已不是當前最難的環節。資料中心建設普遍受制於電力供應,SpaceXAI 的應對方式是自建電源:公司規劃了一座 1.2 吉瓦的自有電廠,以支撐系統全面上線。

自建供電也帶來爭議。公司此前因執行未獲許可的燃氣輪機被周邊社群起訴,隨後承諾拆除這些裝置,但拆除週期長達一年,以便自有電廠逐步投運。這一插曲折射出 AI 資料中心擴張與地方監管、環境許可之間的摩擦正在增多。

百萬 GPU 單站點並非 SpaceXAI 一家的目標。博通曾在 2024 年表示,其有三家超大規模客戶計劃在 2027 年前達到這一量級,但未披露客戶身份。對馬斯克而言,百萬 GPU 只是起點:他表示 SpaceXAI 將在 2027 年把資料中心容量擴大七倍,並瞄準 2030 年實現 5000 萬塊 H100 等效算力。此外,SpaceX 還計劃發射由百萬顆衛星組成的軌道資料中心繫統,儘管黃仁勳稱這一構想目前仍屬“夢想”。

整體來看,這條訊息的關鍵不只是 GPU 數量,而是算力擴張的約束條件正在從晶片轉向電力與土地。自建 1.2 吉瓦電廠、租出舊叢集做推理、規劃軌道資料中心,都是圍繞這一約束做出的安排。對產業鏈而言,GB300 的集中交付節奏、燃氣發電與電網接入裝置、以及推理算力的對外供給,都是後續值得跟蹤的變數。