昆仑芯 昆仑1 (818-300)
产品概述
昆仑1(训练型 818-300) 是百度自主研发的中国第一款云端全功能 AI 芯片,于 2018 年 7 月 4 日百度 AI 开发者大会(Baidu Create 2018) 由李彦宏首次发布,包含训练芯片 昆仑818-300 与推理芯片 昆仑818-100 两款。2021 年百度将芯片业务独立为昆仑芯科技(Kunlunxin),昆仑1 也成为昆仑芯产品线的起点。
昆仑1 采用百度自研 XPU 神经处理器架构与三星 14nm 低功耗制程 + I-Cube 封装,在 100+ 瓦功耗下提供 260 TOPS 算力、 512 GB/s 内存带宽,是当时"业内设计算力最高的 AI 芯片"。它针对语音、NLP、图像、搜索排序、自动驾驶等场景专门优化,支持 PaddlePaddle 等多个深度学习框架,是百度 8 年 AI 加速器积累(20 余次迭代)的结晶。后续演进为 昆仑2(第二代) 与 昆仑芯 M 系列 / P800 等。
核心规格
| 项目 | 参数 |
|---|---|
| 架构 | 百度自研 XPU 神经处理器架构 |
| 制程 | 三星 14nm,I-Cube™(Interposer-Cube)封装 |
| INT8 算力 | 260 TOPS |
| FP16 / BF16 算力 | 未公开(官方仅公布 260 TOPS 整数算力) |
| FP32 算力 | 未公开 |
| 显存带宽 | 512 GB/s |
| 显存容量 | 未公开 |
| 显存类型 | 未公开(高带宽内存,板载) |
| TDP | ~100 – 150 W(官方初称 100+W;后续资料记 150W) |
| 互联 | PCIe(云端全功能,具体代际未公开) |
| 接口 | PCIe(具体代际未公开) |
| 发布 | 2018-07(Baidu Create 2018) |
| 量产/上市 | 2019 年初量产(2020 年起规模出货) |
⚠️ 规格说明:260 TOPS / 512 GB/s / 三星 14nm / 100+W 来自百度官方发布与环球网、新华社等报道,为权威数据。FP16/FP32 峰值算力、显存容量与类型、具体 PCIe 代际官方未披露,标注为未公开。发布时间以 2018-07 百度 Create 为准;量产节点部分资料记为 2019 年初、部分记为 2020 规模出货,表中一并注明。
关键特性
- 云端全功能:覆盖数据中心、公有云、无人车研发等云边全场景
- XPU 自研架构:针对语音、NLP、图像、搜索排序专门优化
- 低成本:同等性能下成本降低约 10 倍(官方宣称)
- 易用:支持 PaddlePaddle 等多框架,编程灵活,支持训练与预测
- 高算力密度:260 TOPS,发布时为业内设计算力最高
厂商信息
| 项目 | 内容 |
|---|---|
| 公司 | 昆仑芯(北京)科技有限公司(原百度 AI 芯片事业部,2021 独立) |
| 总部 | 北京 |
| 成立 | 芯片业务 2018 起;公司 2021 独立 |
| 前身 | 百度(Baidu) |
适用场景
- ✅ 云端 AI 训练与推理(搜索排序、语音、NLP、图像)
- ✅ 自动驾驶车载研发计算
- ✅ 大规模推荐系统
- ✅ 百度系及国产 AI 平台
- ❌ 极致低功耗边缘场景(数据中心定位)
- ❌ 后续新一代大模型(算力与显存受限,已由昆仑2/P800 接替)
相关卡
- 昆仑芯 P800 — 新一代训练旗舰(代际后续)
- 昆仑芯 M100 — 昆仑芯推理/边缘产品
- 昆仑芯 M300 — 昆仑芯推理产品
- 百度 昆仑芯 R200 — 百度系 AI 加速卡