VAST Data 於 7 月 24 日宣佈與 AMD 擴大技術合作,旨在幫助 AI 雲服務商和企業構建並運營大規模高效能 AI 工廠。此次合作的核心是將 VAST 的 AI 作業系統與 AMD 的 6 代 EPYC 處理器Instinct GPU 以及 Pensando Pollara 400 AI 網絡卡 深度整合,以支援可擴充套件的訓練、推理和智慧體工作負載。

隨著行業從模型訓練轉向大規模推理和智慧體應用,基礎設施需求正在發生根本性變化。VAST Data 全球技術聯盟副總裁 John Mao 表示,推理本質上是一個數據問題,成功取決於如何高效地將資料、記憶體、上下文和計算資源作為統一系統進行管理。為此,VAST 的 DASE 架構 提供了多租戶隔離、多協議訪問和統一全域性名稱空間,以簡化分散式環境中的資料訪問,並提高硬體利用率。

合作的具體內容包括:VAST 將採用 6 代 AMD EPYC 處理器 為其新一代 CBox 和 EBox 平台提供算力,該處理器支援 PCIe Gen-6,可提供兩倍於上一代的 I/O 頻寬,從而提升檔案與物件儲存效能。此外,VAST、AMD 與網路公司 DriveNets 共同開發了 AI 基礎設施參考架構,該架構結合了 AMD Helios 機架級 AI 基礎設施、VAST AI OS 和 DriveNets AI Fabric 網路,為模型訓練、推理、強化學習和 KV 快取工作負載提供部署指南。

在效能最佳化方面,VAST 與 AMD 擴充套件了生態合作,與 TensorMesh 和 EmbeddedLLM 等軟體創新者合作,加速面向智慧體應用的推理架構部署。早期測試顯示,在 AMD Instinct MI355X GPU 上,通過 VAST 進行 KV 快取解除安裝,在高併發智慧體工作負載下,首 Token 延遲降低了 9 倍Token 吞吐量提升了 9.7 倍。這些最佳化對於實現低延遲、低成本和節能的推理部署至關重要。

合作還涉及自動化的 KV 快取生命週期管理,利用 VAST 的資料生命週期策略自動過期和刪除包含敏感資訊的快取資料,以幫助企業滿足合規要求。AMD Pensando Pollara 400 AI 網絡卡 則為 GPU 與 VAST 儲存叢集之間的高速資料路徑提供支援,通過 NFS over TCP 和 RDMA 協議高效傳輸資料。

VAST 表示,這些整合方案已在多家領先的 AI 雲服務商中得到部署,為全球客戶提供基於 AMD 技術的 AI 服務。此次合作反映了 AI 基礎設施正從單純追求算力轉向更注重系統級效率和資料管理能力,以適應推理和智慧體時代的新需求。