AMD 於 2026 年 7 月 23 日正式釋出 Instinct MI400 系列 GPU,這是其針對 AI 與高效能運算(HPC)工作負載的最新一代加速器。該系列包含兩款產品:MI455X 面向前沿 AI 部署的訓練與推理,MI430X 則聚焦主權 AI 與科學計算。
AMD 高階副總裁兼 AI 業務負責人 Vamsi Boppana 表示,下一代 AI 將涵蓋前沿 AI、主權 AI 和科學計算,每種場景都需要針對其獨特需求最佳化的基礎設施。MI400 系列正是基於這一理念,在開放軟體基礎上提供定製化解決方案。
MI400 系列採用 CDNA 5 架構 和 2nm 製程。MI455X 配備 432GB HBM4 記憶體,相比上一代 MI355X 的 288GB HBM3E 提升 1.5 倍,峰值記憶體頻寬提升約 2.9 倍。該晶片擁有 36 條低延遲擴充套件鏈路,總擴充套件頻寬達 3.6 TB/s,兩個 96MB L2 快取,整合 3200 億個電晶體。AMD 宣稱其峰值 MXP4 效能達 40.26 petaflops。最多可將 72 顆 MI455X 組合成一個 pod,用於大規模訓練叢集。
MI430X 則側重科學計算,提供高達 288 TFLOPS 的硬體 FP64 效能。
與 MI355X 類似,MI455X 採用 8 個加速器複合晶片(XCD)小晶片 設計,每個 XCD 包含 32 個工作組分處理器(WGP),取代了此前 MI355X 的 32 個計算單元。每個 XCD 分為兩個著色器引擎,各含 16 個 WGP。
此次釋出正值 AI 晶片市場競爭白熱化之際。輝達憑藉 H100/B200 系列佔據主導地位,而 AMD 通過持續迭代 MI 系列試圖擴大份額。MI400 系列在記憶體容量、頻寬和製程上的升級,直接瞄準大規模 AI 訓練與推理場景,尤其適合需要高記憶體頻寬的萬億引數模型。主權 AI(各國自主建設 AI 基礎設施)和科學計算領域的增長,也為 AMD 提供了差異化切入點。
資料中心運營商和雲服務商是 AMD 的主要目標客戶。MI455X 的高記憶體頻寬與多 GPU 擴充套件能力,可降低大模型訓練中的通訊瓶頸;MI430X 的 FP64 效能則吸引傳統 HPC 使用者。AMD 強調其開放軟體生態(ROCm),以降低客戶從輝達 CUDA 遷移的門檻。
不過,AMD 仍需面對輝達強大的生態護城河和客戶慣性。MI400 系列的實際效能表現、能效以及軟體成熟度,將決定其能否在 2026 年下半年及之後的市場中取得突破。