摩尔线程双线作战:MTT S5000 智算卡与"庐山"图形 GPU 的AI+游戏并举
当多数国产 AI 芯片公司all in 大模型算力时,摩尔线程依然坚持"两条腿走路":一手是 MTT S5000 智算卡撑起的夸娥万卡集群,一手是瞄准 3A 游戏的"庐山"图形 GPU。9 月初的半年度业绩说明会给出了两条线的最新坐标——这条"AI+游戏"并举的路线,正在从权宜之计变成差异化壁垒。
一、MTT S5000:平湖架构的训推一体旗舰
MTT S5000 基于第四代 MUSA"平湖"架构,搭载 PH100 芯片、4096 个自研 MUSA Core,2025 年 2 月公开参数。核心规格如下:
| 项目 | 参数 |
|---|---|
| 架构 | MUSA 第四代(平湖),PH100 芯片 |
| 显存 | 80 GB(颗粒类型官方未公开) |
| 显存带宽 | 1.6 TB/s |
| FP8 稠密算力 | 1000 TFLOPS(液冷版)/ 920 TFLOPS(风冷版) |
| BF16/FP16 | 400 TFLOPS |
| FP32 | 100 TFLOPS |
| INT8 | 800 TOPS |
| 互联 | MTLink 784 GB/s(8 卡节点内全互联) |
| TDP | 500 W(市场口径) |
| 形态 | OAM / PCIe,液冷 + 风冷双版本 |
| 单价 | ~$4000–6000(OAM) |
几点澄清值得注意:其一,"单卡 AI 稠密算力 1000 TFLOPS"特指 FP8 精度(液冷版),并非 FP16;其二,80GB 显存的颗粒类型官方从未公布,市场流传的"GDDR6X"说法与 1.6 TB/s 带宽自相矛盾,本站已订正为"类型未公开";其三,S5000 配备硬件级 FP8 Tensor Core,支持 FP8→FP64 全精度,并已基于 FP8 完成 DeepSeek-V4 的 Day-0 适配。加上《安全可靠测评结果公告(2026 年第 2 号)》的通过——AI 训推芯片首次纳入该体系——S5000 同时拿到了信创市场的入场券。
二、万卡落地:夸娥集群与京东云合作
S5000 的成色,最终要靠集群说话。基于夸娥(KUAE)万卡智算集群的实测数据:
| 指标 | 实测值 |
|---|---|
| 集群算力 | 10 EFLOPS |
| Dense 大模型训练 MFU | 60% |
| MoE 大模型训练 MFU | 40% |
| 训练线性扩展效率 | 95%(64 卡→1024 卡保持 90%+) |
| 有效训练时间占比 | >90% |
| 第三方对齐 | 智源 RoboBrain 2.5 与 H100 集群 loss 差异仅 0.62% |
95% 的线性扩展效率背后是 ACE 异步通信引擎——把通信任务从计算核心卸载,实现计算与通信零冲突并行。商业侧,2026 年 3 月签下 6.6 亿元夸娥集群订单;软件侧,MiniMax M3、智谱 GLM-5.2、阿里 Qwen3.5、美团万亿参数 LongCat-2.0 相继完成 Day-0 适配。最关键的落地信号来自 9 月 19 日:京东云与摩尔线程合作的万卡级集群已部署上线服务——从"能跑通"到"规模化服务外部客户",国产 GPU 集群跨过了商用验证的分水岭。随后的数贸会(9 月 23–27 日,杭州)上,摩尔线程集中展示了 AI 智算卡、万卡级集群,以及"模型训练工厂、词元生产工厂、智能体生产工厂"三层能力,产品覆盖云-边-端全场景。
三、"庐山"GPU:从兼容显卡到渲染范式革命
图形产品线上,9 月 3 日半年度业绩说明会披露了新一代"庐山"GPU 的指标——基于花港架构,预计 2026 年底推出:
- 3A 游戏渲染性能提升 15 倍;
- 光线追踪性能提升 50 倍;
- AI 性能提升 64 倍。
比倍数更重要的是两项渲染技术的组合:一是硬件光线追踪,原生支持 DirectX Raytracing,让国产 GPU 第一次在光追管线层面与主流标准对话;二是AI 生成式渲染 AGR,基于全自研 MTAGR 1.0,把渲染范式从"逐像素计算"推向"生成"——用 AI 直接生成画面内容,而非暴力算出每个像素。前者补齐了传统管线的硬件短板,后者则是在渲染范式切换窗口期的卡位:当英伟达 DLSS、AMD FSR 都在走向 AI 化时,AGR 让摩尔线程有机会在下一代渲染标准里占据一席,而不是永远追赶。
四、游戏反哺 AI:双架构复用的独特路线
把两条产品线放在一起看,摩尔线程的打法浮现出独特逻辑:图形与 AI 共享同一套 MUSA 架构底座——SIMT 核心、张量单元、光追核心、统一软件栈全部复用。游戏 GPU 的价值因此不只是营收 diversification:海量游戏场景是最好的架构压力测试与现金流来源,图形侧打磨的调度、显存与光速能力,反向反哺 AI 卡的通用计算质量;而 AI 业务积攒的先进制程流片经验,又拉高图形芯片的天花板。
已登陆科创板的摩尔线程,如今可以用上市平台的融资能力同时养两条产品线。这与纯 AI 芯片公司"单点押注大模型"的路线形成鲜明对比——在国产算力需求旺盛但波动性尚存的市场里,双线作战既是对冲,也是壁垒。
小结
摩尔线程的 2026 年验证了"全功能 GPU"路线的可行性:MTT S5000 以 FP8 稠密 1000 TFLOPS、80GB 显存撑起夸娥万卡集群,并通过京东云万卡级集群部署完成了规模化商用验证;"庐山"GPU 则以硬件光追与 AI 生成式渲染 AGR 完成了从"国产兼容显卡"到"渲染范式探索者"的技术跃迁。图形+AI 双架构复用的独特路线,让摩尔线程在国产 AI 芯片阵营中占据了一个难以复制的生态位。2026 年底"庐山"如期推出与否,将是这条双线故事的下一次大考。