SpaceX正在對其AI資料中心的建設方式進行系統性調整,核心變化是從追求建設速度轉向優先保障可靠性。據The Information援引知情人士訊息,SpaceX新任管理團隊正著手加裝更多電力與冷卻備用系統,要求資料中心在投入運營前完成更全面的測試,並減少對臨時性電力與冷卻裝置的依賴。這一轉向意味著其資料中心擴張速度可能顯著放緩。

這一新做法與xAI此前「邊建設邊運營、後期補充冗餘」的快速部署模式形成鮮明對比。xAI曾將極速建設視為在AI競賽中的核心優勢,其首座資料中心僅用122天便完成搭載10萬塊GPU的上線部署,這一速度曾被輝達CEO黃仁勳稱讚為「超人般的」成就。為實現這一節奏,xAI調集數千名承包商,採用多工序並行作業——冷卻管道鋪設、電氣與網路佈線等往往在同一區域同步推進,而非等上一階段完工再啟動下一階段。SpaceX甚至在今年6月的IPO檔案中將快速建設能力列為重要賣點。

但速度優先帶來了明顯的可靠性代價。據知情人士介紹,前兩座資料中心上線時的冗餘度僅為其他超大規模雲計算服務商的一小部分,單點裝置故障便可能導致整個算力叢集癱瘓;建成初期頻繁斷電曾迫使AI研究人員將專案擱置數小時,並損失部分模型訓練進度。此外,由於團隊成員此前被賦予較高的採購自主權,資料中心內部裝置規格參差不齊,進一步削弱了系統穩定性。

上週,施工作業意外影響一條輸電線路,導致SpaceX位於田納西州孟菲斯的大型資料中心發生一次備受關注的宕機事故。SpaceX表示,此次故障導致部分Grok模型下線,並對Anthropic、谷歌等算力租賃客戶產生連鎖影響。馬斯克隨後在X平台發帖稱,公司正在採取糾正措施,確保此類事件不再發生。

人事層面的調整同步展開。今年6月下旬,馬斯克對資料中心管理層實施大規模調整,由SpaceX老將Wesley Salandro接替Dan Rowland出任團隊負責人。Rowland曾主導基礎設施工程並一度直接向馬斯克彙報,此前還參與過特斯拉Dojo超級計算機專案,在Salandro接手後不久離開。Salandro在SpaceX任職超過七年,曾擔任Falcon和Dragon火箭的生產副總裁。此後數週內,多位核心負責人相繼出走,涉及物理基礎設施、資料中心安全、採購、財務等崗位,部分人員轉投OpenAI、Anthropic等公司。為填補缺口,SpaceX向德克薩斯州Bastrop和佛羅里達州卡納維拉爾角的火箭及Starlink工程師發出志願支援號召,招募參與為期六至八週的輪崗。據悉逾1300名工程師報名,其中超過300人在過去一個月內正式加入資料中心專案。

新管理層不僅調整技術路線,也重塑了組織架構。據知情人士透露,SpaceX在此前相對扁平的管理結構中增設了多箇中層管理職位,員工的裝置採購授權和現場決策權隨之收窄,這在客觀上會進一步拖慢建設進度。馬斯克本人似乎支援這一新策略——據兩位知情人士稱,近幾個月他幾乎每週都會造訪孟菲斯的資料中心設施,通常選擇週日到訪。

從產業視角看,這次調整折射出AI算力擴張進入一個新階段:當資料中心規模從數萬塊GPU邁向更大體量,電力供應、冷卻冗餘與運維穩定性對訓練連續性的影響被放大,單次宕機就可能波及多家外部租戶。對算力租賃客戶而言,供應方的可靠性正成為與價格、交付速度同等重要的考量;對資料中心產業鏈而言,備用電源、冷卻系統與測試驗證環節的價值相應提升。不過知情人士也表示,儘管提前建裝置用系統、加強測試勢必放緩整體程序,SpaceX可能不會完全放棄此前的加速建設模式。如何在重建可靠性與保持擴張速度之間取得平衡,仍是這支新團隊面臨的核心挑戰,尤其是在算力租用業務加速擴張、外部客戶依賴度日益上升的當下。

截至發稿,SpaceX週四美股盤中上漲1.63%,早盤受獲英國政府約4000萬美元衛星服務訂單的訊息影響一度漲超3%,後有所回落。此外,根據招股書披露的安排,SpaceX在9月9日前後迎來IPO後第90天的一輪解禁,最多約3.19億股Class A普通股獲得出售資格,佔相關180天鎖定股份約7%。