AI 雲服務商 QumulusAI 於 2026 年 7 月 24 日宣佈,已與一家專注於生成式 AI 應用的推理平台提供商簽署了一份為期兩年的協議,價值超過 3200 萬美元,將為其供應基於 輝達 Blackwell B300 的 GPU 算力。該協議包含續約選項,預計容量將於 2026 年秋季 上線。
這家未公開名稱的客戶運營著一個為生成式 AI 應用提供快速、可擴充套件基礎設施的平台,服務於執行影像、影片及其他生成式模型的開發者和企業。在這些場景中,速度和可靠性直接決定使用者體驗。根據協議,QumulusAI 將提供 專用 GPU 叢集,確保客戶在需求增長時獲得穩定、高效能的算力支援。
QumulusAI 執行長 Mike Maniscalco 表示,生成式媒體工作負載對推理基礎設施構成巨大壓力——影像和影片的推理計算密集,且使用者體驗高度依賴響應速度。他指出,這筆交易反映了公司觀察到的趨勢:推理客戶越來越傾向於尋求可依賴的專用承諾容量,而 QumulusAI 的商業模式正是為此設計,能夠快速部署這類容量。
為支援此類大規模生成式媒體工作負載,通常需要持續的專用算力,而非偶發的搶佔式現貨容量。這種需求動態正體現在像本次協議這樣的多年期承諾中。QumulusAI 將利用其在美國的資料中心設施提供容量。該公司採用需求驅動的部署模式,在分散式託管和自建設施網路中尋找可用電力資源,從而將 GPU 容量上線時間從通常的數年縮短至數月。
這筆超過 3200 萬美元的兩年期協議已計入 QumulusAI 的訂單簿。該公司定位為分散式 AI 雲平台,通過推理優先、需求驅動的部署模式,在多個數據中心站點間提供高效能 GPU 算力,旨在幫助 AI 團隊和企業以更快的速度、更高的靈活性和可控性擴充套件生產級 AI 工作負載。其模式被視為對傳統集中式超大規模雲容量限制的一種替代方案。
此次交易也進一步印證了輝達 Blackwell B300 在推理市場的需求增長。隨著生成式 AI 應用從訓練轉向大規模部署,推理算力正成為新的瓶頸,而長期專用合同的增多表明,雲服務商和終端使用者正在為這一階段提前鎖定資源。