博通在 2026 年 8 月 31 日於拉斯維加斯舉行的 VMware Explore 2026 大會上宣佈,來自谷歌、輝達、NEC、阿里雲和 Z.ai 等提供商的領先 AI 模型已驗證可在 VMware Cloud Foundation (VCF) 上執行。這些模型包括輝達的 Nemotron 3、谷歌 DeepMind 的 Gemma 4、NEC 的 cotomi、阿里的 Qwen3.7-Max 以及 Z.ai 的 GLM 5.2。此舉旨在讓企業能夠將這些模型部署到本地環境,並向用戶提供“模型即服務”。
博通表示,隨著企業因隱私、安全、治理和 AI 代幣經濟學等因素加速將推理工作負載遷移至私有云,VCF 作為一款 AI 和 Kubernetes 原生的統一私有云平台,為各行業組織提供了生產級路徑,可部署多種 AI 模型。根據博通釋出的《Private Cloud Outlook 2026》,56% 的企業已在或計劃在私有云上執行生產級 AI 推理。VCF 能夠同時執行推理工作負載、智慧體應用、容器化服務和傳統虛擬機器,從而消除管理獨立堆疊的運維碎片化問題。
博通稱,根據 MLPerf Inference v5.1 標準的獨立基準測試,VCF 的效能與裸機相當,使其成為企業大規模本地部署 AI 的理想平台。博通 VMware Cloud Foundation 部門全球 AI 與高階服務負責人 Chris Wolf 表示,博通致力於為企業提供最廣泛的 AI 模型,並已全部在 VCF 上驗證,通過與全球領先的 AI 模型提供商合作,為企業提供資料主權和規模化 AI 的清晰路徑。
VCF 支援 AMD、英特爾和輝達的混合計算,讓企業可自由選擇適合其 AI 工作負載的 GPU 和 CPU 硬體。VCF 預設使用 vLLM 作為模型執行時,可執行超過 150 個開源模型。此次宣佈的已驗證模型各具特點:Nemotron 3 採用混合 Mamba-Transformer MoE 架構,支援 100 萬上下文和多環境強化學習,適合長期執行的智慧體工作流;Gemma 4 是谷歌 DeepMind 最新的開源多模態模型系列,面向開發者和研究社群,支援本地執行和自主 AI 智慧體構建;NEC 的 cotomi 針對日語最佳化,基於精選高可靠性資料集訓練,在高速處理的同時將 token 效率提升 40%;Qwen3.7-Max 是阿里的專有多模態模型,提供 100 萬 token 上下文視窗和先進的多模態推理能力;GLM 5.2 是 Z.ai 的開源通用語言模型,支援企業本地部署編碼和推理智慧體。
多位合作伙伴高管對此發表評論。谷歌 DeepMind 產品管理總監 Olivier Lacombe 表示,VCF 為企業部署 Gemma 4 提供了安全、受治理的基礎,結合其零信任安全架構和模型上下文協議支援,企業可在自有基礎設施內構建和部署自主 AI 智慧體。NEC 首席 AI 官 Akio Yamada 表示,cotomi 專為企業理解日語和商業語境而設計,VCF 為其提供了私有、安全的規模化部署基礎設施,並提到 NEC 提供由 VMware 支援的私有基礎設施服務。ThinkOn 執行長 Craig McLellan 則強調,企業客戶需要尊重資料主權和監管邊界的 AI 推理,在 VCF 上部署企業級 AI 模型可提供主權 AI 框架,讓組織完全控制其智慧財產權。
此次驗證標誌著主流 AI 模型與私有云平台的進一步融合,為企業本地化部署 AI 提供了更多選擇,同時也反映了 AI 推理工作負載向私有云遷移的趨勢。對於 AI 產業鏈而言,這或將對私有云基礎設施、AI 模型部署方式以及相關硬體生態產生深遠影響。