天数智芯 智铠 150(云端推理加速卡)
产品概述
智铠 150 是天数智芯 智铠系列 面向 AI 推理 的加速卡,在系列中定位高于智铠 100。它基于标准通用 GPGPU 架构设计(而非专用 ASIC),因此具备完整的可编程能力与通用计算指令集。
这一设计选择带来关键优势:能够快速适配不断迭代的大模型算法,无需针对单一场景重新流片。大模型架构从纯 Decoder 走向 MoE、多模态融合,推理负载的计算特征持续变化,专用芯片很容易在半年内出现架构过时;而通用 GPU 凭借可编程性,可通过软件优化持续释放性能。
对客户而言,现有基于 CUDA 开发的推理框架与算子可通过编译层快速适配,无需推倒重来,显著缩短上线周期——这也是智铠系列能进入互联网大厂海量推理主力供给的核心原因。
核心规格
| 项目 | 参数 |
|---|---|
| 架构 | 天数智芯通用 GPU 架构(GPGPU,非 ASIC) |
| 产品定位 | 云端 AI 推理 |
| INT8 | 300 TOPS |
| 显存容量 | 32 GB HBM2e |
| 接口 | PCIe Gen4 ×16 |
| 首发 | 2024 年 |
| 价格 | 约 3 万元 |
| TDP | 未公开(同系列参考见智铠系列其他卡) |
⚠️ 规格说明:智铠 150 官方公开信息较为有限,制程、FP16 / FP32 算力、显存带宽、TDP 均未公开。上表 INT8 300 TOPS 与 32 GB HBM2e 来自券商调研纪要,价格约 3 万元为渠道口径。
智铠系列横向对比
| 型号 | INT8 算力 | 显存 | 板级功耗 | 价格 | 定位 |
|---|---|---|---|---|---|
| 智铠 50 | 192 TOPS | 16 GB HBM2e | 75 W | ~1.5 万元 | 边缘 / 工控轻量推理 |
| 智铠 100 | 384 TOPS | 32 GB HBM2e | 150 W | ~2.3 万元 | 云端主流推理(系列主力) |
| 智铠 150 | 300 TOPS | 32 GB HBM2e | 未公开 | ~3 万元 | 云端高密度推理 |
📌 口径提示:智铠 100 在不同信源中存在 192 / 384 / 512 TOPS 三种口径,本站取券商调研纪要的 384 TOPS。智铠 150 的 300 TOPS 低于该口径下的智铠 100,推测两者为不同优化方向(150 可能侧重特定精度或场景),以天数智芯官方数据表为准。
选型建议
- 追求迁移友好:智铠系列的通用 GPU 架构是最大卖点,适合已有大量 CUDA 代码资产、希望低改造成本切换到国产算力的团队
- 追求极致推理性价比:若业务负载固定、可接受算子定制,专用 ASIC(如昆仑芯、昇腾 Atlas 300I 系列)的单位成本可能更优
- 边缘 / 工控场景:应优先选择智铠 50(75 W、半高半长单槽),而非智铠 150