跳到主要内容

AMD Instinct MI350P (CDNA 4, 风冷 PCIe)

产品概述

AMD Instinct MI350P 是 AMD 在 Advancing AI 2026(7月) 发布的风冷 PCIe 扩展卡 AI 加速器,4 年来 AMD 首款 PCIe GPU,面向存量数据中心升级——无需新建液冷机房,即可在现有服务器功率与散热包络内部署生成式 / Agentic AI。

MI350P 本质是 MI350X 的砍半版本:同属 CDNA 4 架构,配备 4× XCD 计算芯粒(TSMC 3nm)+ 1× IOD(TSMC 6nm),730 亿晶体管,144GB HBM3E,风冷即可运行(TDP 450-600W,双插槽)。AMD 强调其 每美元 token 产出 领先(单位成本 Token 效率最高达 NVIDIA RTX PRO 6000 的 4.2 倍),是 MI400 系列"企业升级"购买场景的对应 SKU。

核心规格

项目参数
架构CDNA 4
制程XCD:TSMC 3nm;IOD:TSMC 6nm
晶体管数量730 亿
计算核心128 个计算核心 / 512 个矩阵核心
Infinity Cache128 MB
显存144 GB HBM3E
显存带宽4 TB/s
MXFP4 算力4.6 PFLOPS
MXFP6 算力4.6 PFLOPS
模型支持FP4 下可运行最高 260B 参数模型
TDP450-600 W
形态PCIe 扩展卡(双插槽,风冷)
首发2026 H2(Advancing AI 2026 发布)

📌 官方定位:MI350P 面向「不新建数据中心、在现有风冷机架内升级」的企业客户;AMD 声称不同规模模型下 Token 输出效率领先 RTX PRO 6000 最多 5.1 倍、单位成本 Token 效率领先最多 4.2 倍。

与 MI350X / MI355X 对比

指标MI350XMI350PMI355X
架构CDNA 4CDNA 4CDNA 4
显存288 GB HBM3E144 GB HBM3E288 GB HBM3E
显存带宽8 TB/s4 TB/s8 TB/s
MXFP4~9.4 PFLOPS(推测)4.6 PFLOPS~4.6 PFLOPS(推测)
形态OAMPCIe(风冷)OAM
TDP~1,000 W450-600 W~1,000 W
定位大规模训练/推理企业存量升级大规模训练/推理

企业部署优势

  • 免液冷:450-600W 风冷即可,兼容现有服务器机架与供电
  • PCIe 标准形态:即插即用,无需 OAM 底座
  • 开放软件栈:ROCm + AMD Inference Microservices(AIMs),无授权费,Day-0 支持主流模型
  • 单位成本 Token 效率:对标 RTX PRO 6000 最高 4.2×(AMD 官方数据)

适用场景

  • 企业生成式 / Agentic AI 推理(存量数据中心升级)
  • RAG / 多模态推理(144GB 大显存)
  • 预算敏感的 AI 部署(单位 Token 成本优先)
  • ❌ 前沿大模型训练(算力不足以支撑,需 MI455X)
  • ❌ 新建 AI 工厂(超大规模部署选 Helios)

厂商信息

项目内容
厂商AMD Corporation
正式发布Advancing AI 2026(2026-07)
产品页https://www.amd.com/en/products/accelerators/instinct/mi350.html
首发2026 H2

相关产品