在拉斯維加斯舉行的年度Discover大會上,HPE宣佈了一項對其私有云AI戰略具有節點意義的更新:正式將基於輝達Vera CPU的ProLiant DL394 Gen12伺服器納入HPE Private Cloud AI產品組合。這一動作呼應了當前AI產業從模型訓練向推理執行轉移的大趨勢——當企業開始大規模部署AI應用時,擁有巨大可定址記憶體空間的CPU正迅速成為緊俏資源。
DL394伺服器是HPE本月早些時候在台北國際電腦展上首發的產品,其核心是輝達在今年3月GTC大會上正式推出的Vera CPU。該處理器基於Arm架構,配備88個“Olympus”核心與176個執行緒,支援最高3TB的LPDDR5X記憶體,並能在2U風冷機箱內提供高達每秒1.2TB的記憶體頻寬。這些引數使其特別適合處理大語言模型推理等對記憶體容量和頻寬極度敏感的工作負載。
HPE Private Cloud AI是該公司兩年前推出的統一解決方案棧,整合了HPE伺服器、儲存、網路與軟體,並基於輝達的參考架構構建,涵蓋GPU、乙太網路平台、資料處理單元及網路介面卡。HPE執行副總裁兼技術長Fidelma Russo在大會上透露,該平台已將推理叢集規模擴充套件至最多256個Blackwell級GPU,而DL394伺服器的加入進一步強化了其CPU側的推理能力。
除了Vera CPU的引入,HPE還公佈了一系列配套升級。在安全層面,Private Cloud AI將整合HPE Zerto安全軟體,提供針對惡意代理的防護、持續資料保護以及資料回滾功能,同時支援限制本地代理的行為。在資料網路結構方面,HPE Data Fabric軟體獲得更新,將模型上下文協議支援擴充套件到開源資料流工具Apache Airflow,旨在通過後設資料豐富分散式資料。Russo表示,針對部分客戶在部署資料網路結構軟體時遇到的困難,HPE還將提供預整合的專用裝置,以簡化操作並加快部署速度。
儲存效能的提升同樣值得關注。HPE的Alletra Storage MP X10000儲存陣列此前已在今年春季成為首款通過輝達認證的物件儲存裝置,如今又新增了檔案儲存支援。當該儲存與搭載8顆輝達H200 GPU的DL380a Gen12伺服器配合使用時,客戶的令牌響應時間最多可降低20倍。Russo強調,HPE的架構設計允許物件儲存與檔案儲存並行工作而無需在效能上做出取捨,內建的後設資料管理、加速與KV快取加速服務使其在私有云AI層面的效能較以往有了顯著提升。
此外,HPE還宣佈增強另外兩個相關產品——HPE AI Factory at Scale與HPE Sovereign AI Factory。這兩個方案將獲得輝達機密計算的支援,通過加密認證與加密技術建立“信任鏈”,並結合BlueField與DOCA技術,在本地或主權部署環境中保護模型與私有資料在執行時的安全。
從產業視角看,HPE此次密集釋出傳遞出明確訊號:企業級AI基礎設施的競爭正從單純的GPU算力比拼,轉向涵蓋CPU、儲存、網路、安全與資料管理的全棧整合能力。隨著推理需求逐步超越訓練需求,能夠提供高記憶體頻寬、低延遲資料訪問以及端到端安全防護的私有云方案,將成為大型企業與政府機構部署AI時的關鍵考量。對於輝達而言,Vera CPU進入HPE的主流企業伺服器產品線,也意味著其Arm架構處理器在資料中心市場的滲透正在加速,這將對傳統x86陣營構成持續壓力。