Skip to main content

天数智芯 智铠 150(云端推理加速卡)

产品概述

智铠 150 是天数智芯 智铠系列 面向 AI 推理 的加速卡,在系列中定位高于智铠 100。它基于标准通用 GPGPU 架构设计(而非专用 ASIC),因此具备完整的可编程能力与通用计算指令集。

这一设计选择带来关键优势:能够快速适配不断迭代的大模型算法,无需针对单一场景重新流片。大模型架构从纯 Decoder 走向 MoE、多模态融合,推理负载的计算特征持续变化,专用芯片很容易在半年内出现架构过时;而通用 GPU 凭借可编程性,可通过软件优化持续释放性能。

对客户而言,现有基于 CUDA 开发的推理框架与算子可通过编译层快速适配,无需推倒重来,显著缩短上线周期——这也是智铠系列能进入互联网大厂海量推理主力供给的核心原因。

核心规格

项目参数
架构天数智芯通用 GPU 架构(GPGPU,非 ASIC)
产品定位云端 AI 推理
INT8300 TOPS
显存容量32 GB HBM2e
接口PCIe Gen4 ×16
首发2024 年
价格3 万元
TDP未公开(同系列参考见智铠系列其他卡)

⚠️ 规格说明:智铠 150 官方公开信息较为有限,制程、FP16 / FP32 算力、显存带宽、TDP 均未公开。上表 INT8 300 TOPS 与 32 GB HBM2e 来自券商调研纪要,价格约 3 万元为渠道口径。

智铠系列横向对比

型号INT8 算力显存板级功耗价格定位
智铠 50192 TOPS16 GB HBM2e75 W~1.5 万元边缘 / 工控轻量推理
智铠 100384 TOPS32 GB HBM2e150 W~2.3 万元云端主流推理(系列主力)
智铠 150300 TOPS32 GB HBM2e未公开~3 万元云端高密度推理

📌 口径提示:智铠 100 在不同信源中存在 192 / 384 / 512 TOPS 三种口径,本站取券商调研纪要的 384 TOPS。智铠 150 的 300 TOPS 低于该口径下的智铠 100,推测两者为不同优化方向(150 可能侧重特定精度或场景),以天数智芯官方数据表为准。

选型建议

  • 追求迁移友好:智铠系列的通用 GPU 架构是最大卖点,适合已有大量 CUDA 代码资产、希望低改造成本切换到国产算力的团队
  • 追求极致推理性价比:若业务负载固定、可接受算子定制,专用 ASIC(如昆仑芯、昇腾 Atlas 300I 系列)的单位成本可能更优
  • 边缘 / 工控场景:应优先选择智铠 50(75 W、半高半长单槽),而非智铠 150