Skip to main content

昆仑芯 昆仑1 (818-300)

产品概述

昆仑1(训练型 818-300) 是百度自主研发的中国第一款云端全功能 AI 芯片,于 2018 年 7 月 4 日百度 AI 开发者大会(Baidu Create 2018) 由李彦宏首次发布,包含训练芯片 昆仑818-300 与推理芯片 昆仑818-100 两款。2021 年百度将芯片业务独立为昆仑芯科技(Kunlunxin),昆仑1 也成为昆仑芯产品线的起点。

昆仑1 采用百度自研 XPU 神经处理器架构三星 14nm 低功耗制程 + I-Cube 封装,在 100+ 瓦功耗下提供 260 TOPS 算力、 512 GB/s 内存带宽,是当时"业内设计算力最高的 AI 芯片"。它针对语音、NLP、图像、搜索排序、自动驾驶等场景专门优化,支持 PaddlePaddle 等多个深度学习框架,是百度 8 年 AI 加速器积累(20 余次迭代)的结晶。后续演进为 昆仑2(第二代)昆仑芯 M 系列 / P800 等。

核心规格

项目参数
架构百度自研 XPU 神经处理器架构
制程三星 14nm,I-Cube™(Interposer-Cube)封装
INT8 算力260 TOPS
FP16 / BF16 算力未公开(官方仅公布 260 TOPS 整数算力)
FP32 算力未公开
显存带宽512 GB/s
显存容量未公开
显存类型未公开(高带宽内存,板载)
TDP~100 – 150 W(官方初称 100+W;后续资料记 150W)
互联PCIe(云端全功能,具体代际未公开)
接口PCIe(具体代际未公开)
发布2018-07(Baidu Create 2018)
量产/上市2019 年初量产(2020 年起规模出货)

⚠️ 规格说明260 TOPS / 512 GB/s / 三星 14nm / 100+W 来自百度官方发布与环球网、新华社等报道,为权威数据。FP16/FP32 峰值算力、显存容量与类型、具体 PCIe 代际官方未披露,标注为未公开。发布时间以 2018-07 百度 Create 为准;量产节点部分资料记为 2019 年初、部分记为 2020 规模出货,表中一并注明。

关键特性

  • 云端全功能:覆盖数据中心、公有云、无人车研发等云边全场景
  • XPU 自研架构:针对语音、NLP、图像、搜索排序专门优化
  • 低成本:同等性能下成本降低约 10 倍(官方宣称)
  • 易用:支持 PaddlePaddle 等多框架,编程灵活,支持训练与预测
  • 高算力密度:260 TOPS,发布时为业内设计算力最高

厂商信息

项目内容
公司昆仑芯(北京)科技有限公司(原百度 AI 芯片事业部,2021 独立)
总部北京
成立芯片业务 2018 起;公司 2021 独立
前身百度(Baidu)

适用场景

  • 云端 AI 训练与推理(搜索排序、语音、NLP、图像)
  • 自动驾驶车载研发计算
  • 大规模推荐系统
  • 百度系及国产 AI 平台
  • ❌ 极致低功耗边缘场景(数据中心定位)
  • ❌ 后续新一代大模型(算力与显存受限,已由昆仑2/P800 接替)

相关卡

参考资料