輝達於2026年8月24日釋出Scale-In網路基礎設施,作為其AI網路架構的第五大支柱,旨在為智慧體AI工廠提供加速、安全且統一的南北向訪問。該架構由BlueField-4 DPU、DOCA軟體和Spectrum-X乙太網路共同驅動,將網路、儲存與安全功能從主機CPU解除安裝,以應對多太位元級頻寬下的資料流處理需求。
傳統雲基礎設施為可預測的通用工作負載設計,而智慧體AI工廠需連線多樣化使用者、智慧體、應用、資料來源與儲存系統,每台伺服器需處理多太位元級頻寬,因此專用DPU處理成為必需。Scale-In將南北向網路演進為AI工廠的協調基礎設施域,通過BlueField-4提供主機無關的加速與解除安裝,DOCA提供統一程式設計與運維模型,Spectrum-X乙太網路提供高效能連線,確保安全、資料訪問與運維不成為AI計算擴充套件的瓶頸。
Scale-In是輝達AI網路五大支柱之一,其餘包括:Scale-Up(NVLink連線GPU)、Scale-Out(Spectrum-X與Quantum InfiniBand連線伺服器)、Scale-Across(Spectrum-XGS連線分散式AI工廠)、Context Memory(CMX提供共享KV快取儲存)。Scale-In專注於加速AI計算周邊的訪問、安全、資料移動與基礎設施運維,與CMX互補,後者提供pod級共享KV快取以提升推理效率。
BlueField-4支援高達800 Gb/s的吞吐量,將策略執行、儲存訪問、安全與遙測等基礎設施服務從主機CPU解除安裝,實現租戶隔離、執行時威脅檢測、高效儲存虛擬化與全域性可觀測性。這些功能隨AI工作負載與資料需求擴充套件,確保共享AI基礎設施的安全與高效。輝達表示,Scale-In使運營商能對AI工廠的訪問、資料移動、安全、配置與可觀測性進行一致控制,滿足智慧體AI時代對基礎設施的更高要求。
該架構的推出反映了AI工廠對基礎設施加速與協同設計的迫切需求,傳統軟體定義網路與彈性已不足以支撐大規模智慧體互動。Scale-In通過將基礎設施功能整合為統一域,為AI工廠的規模化部署提供了更可靠的效能保障,對依賴大規模加速計算與資料訪問的AI產業鏈上下游企業具有重要參考價值。