跳到主要内容

互联网巨头自研芯片盘点:百度昆仑芯 R200 与阿里平头哥真武 V900

· 阅读需 7 分钟
Industry Research Team

当英伟达的高端芯片被出口管制挡在门外,中国的互联网巨头们被迫回答同一个问题:算力从哪来?百度和阿里给出的答案最彻底——自己造。一家走自研 XPU 架构的渐进路线,一家以 RISC-V 基因押注全栈闭环。2026 年秋,两家的代表作品分别是昆仑芯 R200 和平头哥真武 V900。

一、巨头自研的三种路线​

把国内互联网巨头的芯片战略摊开,大致可分为三种类型:

路线代表特征
XPU 架构派百度昆仑芯自研指令集架构,从推理切入逐步上探训练
RISC-V + 全栈派阿里平头哥自研 CPU(倚天)+ AI 芯片(真武)+ 互联总线(ICN)全栈闭环
租赁过渡派腾讯自研(紫霄)同时大规模租用海外算力过渡

海外巨头的对照同样值得一看:Meta 与博通合作自研 MTIA 推理芯片,AWS Annapurna 团队与 NVIDIA 合作开发 NVHBM 定制芯片——"自研 + 深度定制"是大厂绕开通用 GPU 溢价的共同选择。而腾讯则提供了一个反例参照:通过租用 Oracle 旗下 10 万颗芯片获得算力,以租赁模式绕开采购限制。三条路线没有绝对优劣,但百度与阿里的坚持,正在长出最完整的技术资产。

二、百度昆仑芯:从 R200 到 P800 的 XPU 演进​

昆仑芯的底层竞争力在于自研 XPU 架构——从 2018 年的昆仑芯 1 代(14nm)到 2021 年的 2 代(7nm Kunlun Core II),再到今天的 XPU-R 与 XPU-P,指令集始终自主。本站收录的两代代表产品:

昆仑芯 R200(2025 年,XPU-R 架构,推理主力):

项目参数
制程7nm
FP3232 TFLOPS
FP16128 TFLOPS
INT8256 TOPS
显存16GB / 32GB GDDR6,512 GB/s
TDP150 W(被动散热)
视频108 路 1080P 解码 / 27 路编码
接口PCIe Gen4 x16

150W 的低功耗加多精度配置,让 R200 主打数据中心大规模推理与视频分析场景——这是百度搜索与信息流业务的算力基本盘。

昆仑芯 P800(2024 年,XPU-P 架构,训推一体):FP16 345 TFLOPS(超越 H20 的 148 TFLOPS)、INT8 820 TOPS、96GB HBM3、2.4 TB/s 带宽、400W、OAM 形态,支持 DeepSeek-V3/R1 671B 满血版单机 8 卡运行,配套天池 256/512 超节点,已交付万卡级集群并实现全自研三万卡集群。昆仑芯科技已于 2026 年 5 月启动科创板 IPO 辅导——从百度内部部门到独立上市,XPU 路线完成了商业验证。

三、阿里平头哥真武 V900:216GB 显存与 50 万卡集群​

2026 年 9 月 22 日云栖大会,平头哥发布新一代训推一体 AI 芯片真武 V900,官方称之为"目前算力性能最强的中国自研 AI 芯片",量产上云时间较原路线图提前至 2027 年第一季度。

项目参数
显存216 GB(超过 B200 的 192GB 与 H200 的 141GB)
片间互联1200 GB/s(自研 ICN 链路,较 M890 提升 50%)
精度原生 FP8 / FP4
性能口径真武 M890 的 3 倍
集群磐久 AL128 超节点,ICN Switch 扩展至 50 万卡
量产2027 年 Q1 上云
软件T-Head SAIL 全栈

与 M890 一致,平头哥未公布绝对 FLOPS、制程与 TDP——业界推测由中芯国际制造,官方未证实。但结构性的信息已经足够:216GB 显存直指大模型时代的"内存墙",1200 GB/s 片间互联对标 NVLink 量级拆解"通信墙"。真武系列的代际节奏同样清晰:810E(96GB/700 GB/s)→ M890(144GB/800 GB/s,GP9A 超节点实例已于 8 月上线,国内首个跑通超 2 万亿参数大模型的超节点形态算力)→ V900 → J900(2027 年 Q3,架构突破性创新)。截至 2026 年 9 月,真武系列已服务超 650 家企业客户。

四、ICN 总线与倚天 CPU:全栈闭环的最后一块拼图​

真武 V900 最大的想象空间不在单芯片,而在 ICN 互联总线构建的全栈闭环:ICN Switch 让 Scale-Up 域内带宽完全对称、原生内存语义与统一编址;磐久 AL128 超节点把真武 V900、ICN Switch、磐脉智能网卡、镇岳 SSD 主控全部收进一套算-存-网协同体系,单一集群可扩展至 50 万卡——这个目标直指 NVIDIA Rubin Ultra NVL576 的规模层级。

同期公布的倚天 CPU 路线图补上了 CPU 侧的拼图:2027 年推出倚天 720/730,其中倚天 730 首次采用全自研微架构,SPECint2017 单核性能(每 GHz)达到倚天 710 的 1.4 倍;倚天 750 支持自研 ICN 总线,实现 CPU 与真武 AI 芯片直连。至此,"倚天 CPU + 真武 AI 芯片 + ICN 网络"的全栈闭环成型——阿里成为国内唯一在 CPU、AI 芯片、互联协议三层都实现自研并互操作的云厂商。

五、对照与启示:自研是巨头的长期主义​

把百度与阿里放回全球坐标系:Meta×博通 MTIA、AWS×NVIDIA NVHBM 说明自研 + 定制是全球巨头的共同选择;腾讯租用 Oracle 10 万颗芯片则展示了"买不到就租"的过渡形态。但中国的特殊性在于出口管制的硬约束——通用 GPU 的获取不确定性,让自研从"降本选项"变成了"生存选项"。百度用 XPU 架构证明渐进路线的可持续,阿里用 RISC-V 基因 + ICN 总线证明全栈闭环的可能性。

小结​

昆仑芯 R200 与真武 V900 分别代表了互联网巨头自研芯片的两个时态:R200 是"现在时"——150W 低功耗推理卡稳定承载着百度的核心业务;V900 是"将来时"——216GB 显存、50 万卡集群与 2027 年 Q1 量产的承诺,瞄准的是数万亿至十万亿参数模型的算力底座。一种路线靠架构自主渐进上探,一种路线靠全栈闭环规模突围,两者共同指向同一个结论:中国互联网巨头的算力命门,正在从采购谈判桌转移回自己的设计图纸。2027 年,当 V900 与倚天 730 如期上云、昆仑芯 R300 落地,这场自研竞赛的下半场才真正开始。