AMD Instinct MI350P (CDNA 4, 风冷 PCIe)
产品概述
AMD Instinct MI350P 是 AMD 在 Advancing AI 2026(7月) 发布的风冷 PCIe 扩展卡 AI 加速器,4 年来 AMD 首款 PCIe GPU,面向存量数据中心升级——无需新建液冷机房,即可在现有服务器功率与散热包络内部署生成式 / Agentic AI。
MI350P 本质是 MI350X 的砍半版本:同属 CDNA 4 架构,配备 4× XCD 计算芯粒(TSMC 3nm)+ 1× IOD(TSMC 6nm),730 亿晶体管,144GB HBM3E,风冷即可运行(TDP 450-600W,双插槽)。AMD 强调其 每美元 token 产出 领先(单位成本 Token 效率最高达 NVIDIA RTX PRO 6000 的 4.2 倍),是 MI400 系列"企业升级"购买场景的对应 SKU。
核心规格
| 项目 | 参数 |
|---|---|
| 架构 | CDNA 4 |
| 制程 | XCD:TSMC 3nm;IOD:TSMC 6nm |
| 晶体管数量 | 730 亿 |
| 计算核心 | 128 个计算核心 / 512 个矩阵核心 |
| Infinity Cache | 128 MB |
| 显存 | 144 GB HBM3E |
| 显存带宽 | 4 TB/s |
| MXFP4 算力 | 4.6 PFLOPS |
| MXFP6 算力 | 4.6 PFLOPS |
| 模型支持 | FP4 下可运行最高 260B 参数模型 |
| TDP | 450-600 W |
| 形态 | PCIe 扩展卡(双插槽,风冷) |
| 首发 | 2026 H2(Advancing AI 2026 发布) |
📌 官方定位:MI350P 面向「不新建数据中心、在现有风冷机架内升级」的企业客户;AMD 声称不同规模模型下 Token 输出效率领先 RTX PRO 6000 最多 5.1 倍、单位成本 Token 效率领先最多 4.2 倍。
与 MI350X / MI355X 对比
| 指标 | MI350X | MI350P | MI355X |
|---|---|---|---|
| 架构 | CDNA 4 | CDNA 4 | CDNA 4 |
| 显存 | 288 GB HBM3E | 144 GB HBM3E | 288 GB HBM3E |
| 显存带宽 | 8 TB/s | 4 TB/s | 8 TB/s |
| MXFP4 | ~9.4 PFLOPS(推测) | 4.6 PFLOPS | ~4.6 PFLOPS(推测) |
| 形态 | OAM | PCIe(风冷) | OAM |
| TDP | ~1,000 W | 450-600 W | ~1,000 W |
| 定位 | 大规模训练/推理 | 企业存量升级 | 大规模训练/推理 |
企业部署优势
- 免液冷:450-600W 风冷即可,兼容现有服务器机架与供电
- PCIe 标准形态:即插即用,无需 OAM 底座
- 开放软件栈:ROCm + AMD Inference Microservices(AIMs),无授权费,Day-0 支持主流模型
- 单位成本 Token 效率:对标 RTX PRO 6000 最高 4.2×(AMD 官方数据)
适用场景
- ✅ 企业生成式 / Agentic AI 推理(存量数据中心升级)
- ✅ RAG / 多模态推理(144GB 大显存)
- ✅ 预算敏感的 AI 部署(单位 Token 成本优先)
- ❌ 前沿大模型训练(算力不足以支撑,需 MI455X)
- ❌ 新建 AI 工厂(超大规模部署选 Helios)
厂商信息
| 项目 | 内容 |
|---|---|
| 厂商 | AMD Corporation |
| 正式发布 | Advancing AI 2026(2026-07) |
| 产品页 | https://www.amd.com/en/products/accelerators/instinct/mi350.html |
| 首发 | 2026 H2 |
相关产品
- AMD MI350 - 同架构旗舰(CDNA 4)
- AMD MI355X - 同架构升级
- AMD MI455X - MI400 系列旗舰
- AMD MI430X - MI400 系列 HPC 款
- 完整对比表