CrusoePerplexity於2026年9月15日宣佈達成一項多年期合作,Perplexity將把其AI工作負載整體遷移到Crusoe Cloud上執行。根據協議,Perplexity將在同一平台上完成完整的模型生命週期:一方面利用Crusoe提供的、搭載輝達GB300 NVL72的專屬叢集訓練前沿模型,並配合輝達InfiniBand網路方案;另一方面通過Crusoe的託管推理(Managed Inference)服務,把這些模型投入生產環境對外提供服務。

這項合作的一個特別之處在於雙向性。除了Perplexity採購算力,Crusoe也將為自身1800名員工引入Perplexity Enterprise Pro與Max,用於網頁與內部知識檢索、多步驟研究、資料分析以及呼叫前沿AI模型。也就是說,兩家公司既是算力供需關係,也互為產品客戶。

Crusoe聯合創始人兼CEO Chase Lochmiller表示,動作最快的AI公司需要能覆蓋整個模型生命週期、並隨業務增長而擴充套件的基礎設施,Perplexity正在構建人們獲取答案的未來,Crusoe希望從“第一個電子到最後一個token”都參與其中。Perplexity聯合創始人兼CEO Aravind Srinivas則強調,在Perplexity的規模上執行AI,每一毫秒延遲都會被使用者直接感知,Crusoe的架構正是圍繞高吞吐、低延遲推理這一約束設計的。

輝達方面,其HPC與AI基礎設施解決方案高階總監Dion Harris表示,現代AI需要從研究到部署的統一計算架構,基於GB300 NVL72與InfiniBand的Crusoe Cloud,能讓Perplexity以智慧體AI所需的速度和效率完成前沿模型的訓練、微調與生產部署。

從產業背景看,Crusoe的定位是所謂“AI工廠”公司,強調以能源為先:通過獲取大規模電力資源、建設面向AI最佳化的資料中心,再疊加雲平台對外輸出算力。這種“能源—資料中心—雲”垂直整合模式,與單純出租GPU的雲廠商形成差異,也呼應了當前AI基礎設施競爭向電力與機房環節延伸的趨勢。

Perplexity方面,公司成立於2022年,最初以AI答案引擎切入搜尋,如今定位為AI智慧體平台,旗艦產品為Perplexity Computer,一個跨工具、檔案、晶片與裝置的模型無關智慧體編排器。據其披露,Perplexity每月在全球回答超過15億個問題。對這樣一家面向海量即時請求的產品公司而言,推理延遲與吞吐直接決定使用者體驗,把訓練與推理放在同一平台,理論上可以減少模型迭代到上線之間的摩擦。

對關注AI產業鏈的讀者來說,這條訊息有幾層含義。其一,前沿模型公司正在把訓練和推理的算力採購集中到少數具備垂直整合能力的供應商,雲服務的競爭點從“有沒有GPU”轉向“能否覆蓋全生命週期並控制成本”。其二,GB300 NVL72這類新一代機架級系統被明確寫入合作協議,說明新一代算力平台的商用落地正在推進,對上游晶片、網路與資料中心電力供應鏈都是需求訊號。其三,Crusoe以能源為起點的模式若被更多模型公司接受,可能進一步抬高AI資料中心選址與電力獲取在產業競爭中的權重。

需要注意的是,該訊息以新聞稿形式釋出,屬於企業對外披露的合作資訊,具體合同金額、算力規模與部署時間表均未公佈,實際執行節奏仍有待觀察。