MI400 系列盘点:MI430X 驱动欧洲 LUMI-AI 超算,AMD HBM4 家族成型
当 MI430X 与第六代 EPYC 确定驱动欧洲 LUMI-AI 超算,AMD 的 HBM4 家族不再只是 PPT 上的参数表,而是正在被国家级算力项目、超大规模云厂商与 AI 实验室同时验证的产品矩阵。本文盘点 MI400 系列的完整版图,以及它背后的收购组合拳。
MI400 系列:一张覆盖三大场景的产品矩阵
MI400 系列于 CES 2026 正式发布,在 Advancing AI 2026 上确认了清晰的 SKU 分层。三款产品覆盖了数据中心采购的三种典型场景:
| 型号 | 定位 | 显存 | 算力 | 出货时间 |
|---|---|---|---|---|
| MI455X | 前沿训练 + 推理旗舰(Helios 机架专用) | 432GB HBM4 | 40 PFLOPS 级 MXFP4(dense) | 2026 H2 起量产 |
| MI430X | HPC / 主权 AI(硬件 FP64 加速) | 432GB HBM4 | 硬件 FP64 288 TFLOPS | 2027 H1 |
| MI350P | 企业存量升级(风冷 PCIe) | 144GB HBM3E | 4.6 PFLOPS MXFP4 | 已出货 |
再往远看,AMD 已在 Advancing AI 2026 预告了下一代 MI500 系列:CDNA 6 架构、台积电 2nm、HBM4E 显存,预计 2027 年发布,由 AMD 与 OpenAI 联合定义开发。从 MI400 到 MI500,加上此前的 MI350(CDNA 4)与 MI300X,AMD 的产品路线第一次形成了以年度为节奏的完整梯队,而非零星的单点反击。
值得注意的是,MI455X 与 MI430X 共享同一套 CDNA 5 加 432GB HBM4 的硬件底座——AI 吞吐优先与 FP64 精度优先通过同一平台的不同调校实现,这大幅摊薄了研发与生态适配成本。
MI430X:用 FP64 锁定国家级超算
MI430X 是 MI400 家族中最具象征意义的一款。它与 MI455X 同样配备 432GB HBM4、23.3TB/s 带宽,但核心差异在于原生硬件级 FP64 双精度:288 TFLOPS,约为 NVIDIA Vera Rubin 的 8.7 倍。这是一个精准卡位——双精度科学计算是 NVIDIA 在消费级 AI 浪潮中相对弱化的领域,而它恰恰是国家级超算的刚需。
MI430X 已经锁定两套国家级系统:
- 美国 ORNL "Discovery":橡树岭国家实验室新一代超算,2028 年部署;
- 法国 "Alice Recoque":GENCI 与 CEA 联合打造的欧洲系统。
AMD 官方已在 8 月 4 日财报电话会确认,MI430X 正在 ORNL 与法国 Jean Zay 的 exascale 级超算中运行。而根据最新进展,MI430X 与第六代 EPYC 将共同驱动欧洲 LUMI-AI 超算——LUMI 是欧洲最强的超算系统之一,其 GPU 分区此前基于 MI250X,此次升级至 HBM4 平台,是欧洲主权 AI 对 AMD 路线的直接背书。
超算背书对 ROCm 生态的拉动
国家级超算项目的价值远超订单本身。超算是软件生态最好的试炼场:混合精度科学计算、大规模 MPI 并行、异构调度,这些极端场景会把 ROCm 的短板逼出来并倒逼修复。同时,超算项目通常要求开源软件栈与长期维护承诺,这与 ROCm 的开源路线天然契合。ORNL、Jean Zay、Alice Recoque、LUMI-AI 构成的"超算联盟",正在为 ROCm 提供一种商业市场买不到的信誉资产——当欧洲与美国的公共算力项目都选择 AMD 时,商业客户的采购顾虑会显著降低。
平台协同:EPYC Venice 与 2nm 双线量产
MI400 家族的算力释放离不开主机侧的配套。第六代 EPYC "Venice"(Zen 6,最高 256 核,1.6TB/s 内存带宽)已在台积电 2nm 产线启动量产,并延伸至美国亚利桑那工厂——这使 AMD 成为唯一在两个地区都有先进制程量产能力的 x86 服务器 CPU 厂商。下一代 "Verano" 已为 AI 工作负载预留设计,将延续 CPU 与 GPU 平台协同的打法。
CPU 与 GPU 的协同不是简单的搭配销售。在 Helios 机架中,每托盘 4 颗 MI455X 配 1 颗 Venice,CPU 负责数据搬运与调度,CPU-GPU 互联带宽是上一代的 2 倍。对推理集群而言,主机侧的数据预处理好坏直接影响 GPU 利用率——这正是 AMD"CPU 加 GPU 双引擎"路线在 AI 时代的复利。
收购组合拳:内存、推理与空间智能
围绕 MI400 平台,AMD 在 2026 年展开了一组方向明确的收购:
| 收购标的 | 能力方向 | 战略意图 |
|---|---|---|
| MEXT | 内存访问优化 | 强化 HBM4 时代的显存子系统效率 |
| Taalas | 快速推理硬件 | 补充推理专用架构能力 |
| World Labs | 空间智能 / 物理 AI | 卡位世界模型与机器人时代 |
三笔收购分别对应内存、推理与物理 AI 三条线,加上与 OpenAI、Meta 各约 1000 亿美元级的合作以及 Anthropic、微软的合作,AMD 正在从"卖芯片"走向"卖 AI 基础设施能力"。这组拼图的完整解读,我们将在后续文章中展开。
市场机会与追赶空间
AMD 管理层看到的机会窗口清晰而巨大:推理与数据中心 CPU 合计 2200 亿美元的市场机会。推理是 AI 商业化落地的主战场——训练市场已被 NVIDIA 牢固占据,但推理市场的格局远未定型,对显存容量、单位 token 成本与开放生态的敏感度更高,这正是 MI400 家族的差异化所在。
但差距同样不能回避:AMD 的市值仍不足 NVIDIA 的五分之一,CUDA 生态的迁移成本依然存在。分析师普遍认为,这种差距本身就是追赶空间——如果 MI400 系列与 Helios 的 6GW 级订单按期兑现,AMD 在 AI 加速器市场的份额将获得结构性提升。
小结
MI400 系列的意义在于"家族成型":MI455X 打前沿训练与推理,MI430X 用 FP64 锁定 HPC 与主权 AI,MI350P 覆盖企业存量升级,MI500 预告下一代——四个层次共享平台底座,配合 EPYC Venice 的 2nm 双厂量产,AMD 第一次拿出了一条完整、连贯、可预期的数据中心产品线。LUMI-AI 等超算的背书正在为 ROCm 生态积累信誉,而 MEXT、Taalas、World Labs 的收购则为这张版图补上了内存与物理 AI 的拼图。2027 年 MI430X 正式出货时,我们将能看到这套组合拳的完整威力。