AMD 于 2026 年 7 月 23 日正式发布 Instinct MI400 系列 GPU,这是其针对 AI 与高性能计算(HPC)工作负载的最新一代加速器。该系列包含两款产品:MI455X 面向前沿 AI 部署的训练与推理,MI430X 则聚焦主权 AI 与科学计算。
AMD 高级副总裁兼 AI 业务负责人 Vamsi Boppana 表示,下一代 AI 将涵盖前沿 AI、主权 AI 和科学计算,每种场景都需要针对其独特需求优化的基础设施。MI400 系列正是基于这一理念,在开放软件基础上提供定制化解决方案。
MI400 系列采用 CDNA 5 架构 和 2nm 制程。MI455X 配备 432GB HBM4 内存,相比上一代 MI355X 的 288GB HBM3E 提升 1.5 倍,峰值内存带宽提升约 2.9 倍。该芯片拥有 36 条低延迟扩展链路,总扩展带宽达 3.6 TB/s,两个 96MB L2 缓存,集成 3200 亿个晶体管。AMD 宣称其峰值 MXP4 性能达 40.26 petaflops。最多可将 72 颗 MI455X 组合成一个 pod,用于大规模训练集群。
MI430X 则侧重科学计算,提供高达 288 TFLOPS 的硬件 FP64 性能。
与 MI355X 类似,MI455X 采用 8 个加速器复合芯片(XCD)小芯片 设计,每个 XCD 包含 32 个工作组分处理器(WGP),取代了此前 MI355X 的 32 个计算单元。每个 XCD 分为两个着色器引擎,各含 16 个 WGP。
此次发布正值 AI 芯片市场竞争白热化之际。英伟达凭借 H100/B200 系列占据主导地位,而 AMD 通过持续迭代 MI 系列试图扩大份额。MI400 系列在内存容量、带宽和制程上的升级,直接瞄准大规模 AI 训练与推理场景,尤其适合需要高内存带宽的万亿参数模型。主权 AI(各国自主建设 AI 基础设施)和科学计算领域的增长,也为 AMD 提供了差异化切入点。
数据中心运营商和云服务商是 AMD 的主要目标客户。MI455X 的高内存带宽与多 GPU 扩展能力,可降低大模型训练中的通信瓶颈;MI430X 的 FP64 性能则吸引传统 HPC 用户。AMD 强调其开放软件生态(ROCm),以降低客户从英伟达 CUDA 迁移的门槛。
不过,AMD 仍需面对英伟达强大的生态护城河和客户惯性。MI400 系列的实际性能表现、能效以及软件成熟度,将决定其能否在 2026 年下半年及之后的市场中取得突破。