DeepSeek 确认押注华为芯片训练大模型:从 16 万颗 950DT 传闻到"必须成功"的站队
· 阅读需 5 分钟
2026 年 9 月 22 日,多家媒体报道:DeepSeek CEO 明确表示公司正大力押注华为芯片,预计将收到新一批华为芯片用于大模型训练,并强调"这一选择必须成功"。这是继此前"DeepSeek 拟采购 16 万颗昇腾 950DT 跑推理"报道之后,国产算力生态迄今最重要的站队信号——从推理采购升级为训练押注。
1. 信号链:四步走到"训练押注"
把过去半年的公开信息串起来,DeepSeek 与昇腾的合作有一条清晰的升级路径:
| 时间 | 信号 | 性质 |
|---|---|---|
| 2026 年中 | DeepSeek V4 完成从 CUDA 到 CANN 的生态迁移 | 软件适配 |
| 2026 年 8 月 | 报道:DeepSeek 拟采购 16 万颗昇腾 950DT 部署推理 | 推理采购意向 |
| 2026-09-17 | HC2026:960DT 提前三个季度就绪,950DT Q4 放量 | 供给兑现 |
| 2026-09-22 | DeepSeek CEO:押注华为芯片训练大模型,"必须成功" | 训练押注 |
关键变化是负载等级:推理部署是"用现成算力降本",训练押注则是"把下一代模型的存在性押在国产芯片上"——训练集群对稳定性、互联效率、软件栈成熟度的要求高一个量级。
2. 华为侧的兑现能力
DeepSeek 敢于站队,背后是华为供给侧一系列可核验的进展(均为官方口径):
- 一年一代兑现:950PR 已量产、950DT 2026 Q4 放量、960DT 从原计划 2027 Q4 提前三个季度至 2027 Q1 就绪 / Q2 上市——路线图可信度连续两次验证;
- 部署规模:昇腾超节点已规模商用超 1000 套,覆盖互联网、金融、医疗、制造;
- 生态成熟:CANN 进入常态化开源运营,外部开发者占比首次超过 61%,月活开发者 5200 人;基于昇腾的原生训练模型超过 40 个,是国内唯一支持预训练的技术路线;
- 训练证据链:中国电信 9 月开源的星(Xing)4.0-29B-A4B agentic MoE 模型宣布在昇腾上端到端训练(公司口径)——昇腾"能训大模型"不再只有华为自证。
规格详见昇腾 950DT 与昇腾 960 规格页;超节点分析见昇腾 960 官宣发布。
3. 为什么是 DeepSeek?
DeepSeek 的选择有强结构性动因:
- 供给确定性:在出口管制约束下,NVIDIA 旗舰对华供给持续收紧;国产算力是唯一可规划的大规模训练供给;
- 成本结构:DeepSeek 一贯以极致工程效率著称(V3 训练成本即为业内标杆),国产算力叠加超节点系统效率符合其路线;
- 对赌生态红利:CANN 开源 + 头部模型厂商深度绑定,模型厂商可以参与定义工具链走向——这在 CUDA 封闭体系内不可能发生;
- 示范效应自我实现:头部实验室公开站队会反向拉动华为产能排期、上游 HBM 与整机的投入,"必须成功"因此是理性承诺而非口号。
4. 风险与待验证项
冷静看,这条路线仍有三处需要时间验证:
- 实际训练规模:新一批芯片的数量、型号(950DT 还是 960DT)、交付节奏均未披露;
- MFU 口径:华为给出的 MFU / 时延收益均出自马尔科夫实验室仿真,尚无独立第三方实测;训练集群的真实有效算力要看大规模生产环境的长期数据;
- 单卡代差:960DT FP4 4 PFLOPS 对比 Rubin R200 的 50 PFLOPS(FP4),单卡代差客观存在——训练效率取决于超节点规模与软件优化能否补足,这正是"系统级竞争"的胜负手。
5. 小结
- DeepSeek 确认押注华为芯片训练大模型——国产算力首个头部实验室训练级站队;
- 信号链:CUDA→CANN 迁移 → 16 万颗 950DT 推理采购传闻 → 960 提前就绪 → 训练押注;
- 支撑面:一年一代兑现、超节点 1000+ 套、CANN 开源生态外部开发者 61%;
- 看什么:新一批芯片的实际到货与训练集群规模、第三方 MFU 数据、下一次 DeepSeek 发版的训练算力披露。
相关阅读
- 昇腾 960 规格页 / 昇腾 950DT 规格页(本站)
- 昇腾 960 官宣发布:FP4 算力翻倍、全球首个 NPO 超节点
- 国产三强 2026 H2:国产化率突破 40% 向 60% 迈进
- 阿里真武 V900 云栖大会发布
参考资料
- 今日头条·今日科技早报:DeepSeek 确认押注华为芯片用于大模型训练(2026-09-22)
- 华为全联接大会 2026 官方发布(2026-09-17)
- 此前报道:DeepSeek 拟采购 16 万颗昇腾 950DT(2026-08)
本文基于公开报道与厂商官方口径整理。芯片数量、训练集群规模等细节以 DeepSeek 与华为后续披露为准。