黑芝麻智能 华山 A2000 (Huashan A2000)
产品概述
华山 A2000 是 黑芝麻智能(Black Sesame Technologies,港股 02533.HK) 面向下一代 AI 模型设计的高算力车规芯片平台,也是 华山 A1000 之后的代际跨越产品。其定位从"智驾芯片"扩展为**"物理 AI 时代的端侧算力底座"**,覆盖从座舱 AI 化到 L3/L4 级 Robotaxi 的全场景端侧推理需求,并延伸至具身智能与泛 AI 端侧应用("始于车,不止于车")。
产品历程较为特殊,命名经历过一次调整:
- 2024 年 12 月 30 日,黑芝麻智能首次宣布推出华山 A2000 家族,当时包含 A2000 Lite / A2000 / A2000 Pro 三款,分别对应城市智驾、全场景通识智驾、高阶全场景通识智驾。
- 2025 年 1 月,A2000 芯片流片成功。
- 因性能与集成度触及美国商务部工业安全局(BIS)先进计算芯片出口管制红线,A2000 经历了长达 11 个月的美国商务部与国防部审查,最终于 2025 年底获批、2026 年 1 月 4 日 公开宣布通过审查,获准全球销售与应用;CEO 单记章称其为国内唯一通过此类审查的企业。获批关键在于 A2000 是车规级自动驾驶场景优化架构,不具备数据中心 GPU 那样的极高"性能密度"与大规模集群互联带宽,且终端用途为民用汽车。
- 2026 年 1 月 6–9 日 CES 2026,A2000 首次公开亮相并获 CES 2026 最佳半导体产品奖。
- 2026 年 1 月 28 日,发布以 A2000 为核心的 FAD2.0 开放平台(准量产级)。
- 2026 年 4 月 11 日(智能电动汽车发展高层论坛)与 4 月 20 日,单记章正式发布 A2000 家族全新阵容,型号更新为 A2000N / A2000L / A2000U / A2000X 四档。
技术规格:A2000 家族研发历时三年多,采用 7nm 先进制程,集成多核 Arm Cortex-A78AE CPU、GPU,以及自研 九韶(Jiushao)NPU 与自研高性能 ISP。九韶 NPU 采用"物理 Unique AI 运算设计"(大核架构),无核间同步开销,全链路原生支持 INT4 / INT8 / FP8 / FP16 / FP32 混合精度,FP16 模型无需量化即可直接运行;针对 Transformer 类模型对 reshape、transpose、grid_sample 等非计算类算子做了硬加速,并调整了指数运算单元与 MAC 单元比例;原生支持随机舍入。另一核心设计是近存计算:配备带宽高达 8 TB/s 的百 MB 级 NPU 专用高速片上缓存,构成"NPU 专用缓存 + 核心模块片内共享缓存 + 深度优化 DDR"的三层内存架构,大幅降低时延与功耗。感知侧 ISP 支持 4 曝光、150dB HDR,RAW 格式高效直通 NPU。功能安全采用独创 "3L"三层隔离架构(L1 高性能计算域 ASIL-B / L2 确定性安全域 ASIL-D 双核锁步 / L3 独立安全域硬隔离)+ Safety NPU 冗余校验,整体满足 ISO 26262 ASIL-D。旗舰版本最高可支持 24 颗摄像头同时工作。配套 BaRT AI 工具链(基于 MLIR)原生兼容 PyTorch 推理 API、支持 Triton 自定义算子自动化编译,可实现分钟级极速编译。
市场进展:A2000 已获多个量产定点——2026 年 2 月 24 日 与国汽智控联合方案获国内某头部车企定点(覆盖 L2+ 至 L3 全场景,首批车型预计 2026 年内量产);公司已与国内销量前六大车企中的五家建立深度合作,比亚迪 等头部车企有望 2026 年批量装车。官方披露 A2000 系列将于 2026 年下半年正式启动量产装车。黑芝麻智能 2025 年业务增长超 75%,2026 年全年芯片出货目标远超 1000 万颗。
核心规格
| 项目 | 参数 |
|---|---|
| 架构 | 自研 九韶(Jiushao)NPU 大核架构 + 近存计算;多核 Arm Cortex-A78AE CPU + GPU + DSP + 自研 ISP |
| 制程 | 7nm 先进制程 |
| FP16 / BF16 算力 | 未公开(架构原生支持 FP16 且免量化直跑,但官方未公布 FP16 TFLOPS 数值) |
| INT8 算力 | 等效算力四档:A2000N 200 TOPS / A2000L 400 TOPS / A2000U 700 TOPS / A2000X 1000 TOPS |
| FP32 算力 | 未公开(全链路支持 FP32 精度,未公布算力数值) |
| 支持精度 | INT4 / INT8 / INT16 / FP8 / FP16 / FP32 混合精度,原生支持随机舍入 |
| 显存容量 | 未公开(由域控/计算平台方案选配) |
| 显存类型 | 未公开(DDR 带宽利用率经深度优化;官方未披露具体代际) |
| 显存带宽 | 未公开(片上缓存带宽 8 TB/s,容量百 MB 级) |
| TDP | 未公开。> 官方仅披露 200 TOPS 级版本能效比约 3 TOPS/W,据此推算该档功耗约 60–70W 量级;更高算力档位功耗官方未公布,待官方确认 |
| 互联 | 支持芯片间高速一致性互联,可多芯片协同扩展以满足 L4 级(>2000 TOPS)算力需求(具体带宽未公开) |
| 接口 | SoC 板载;A2000 计算平台提供桌面级与车规级双重接口、可扩展核心板设计;支持 24+ 路摄像头、4 路万兆以太网 |
| ISP | 自研高性能 ISP,支持 4 曝光、150dB HDR,RAW 直通 NPU |
| 功能安全 | ISO 26262 ASIL-D;独创 "3L" 三层隔离安全架构(L1 ASIL-B / L2 ASIL-D 双核锁步 / L3 硬隔离独立安全域)+ Safety NPU 冗余校验 |
| 工具链 | BaRT(基于 MLIR,Model Compiler / DAL / HAPPY / Runtime 四模块),原生兼容 PyTorch 推理 API,支持 Triton 自定义算子自动编译、PTQ/QAT 全流程量化 |
| 发布 | 2024-12(2024-12-30 家族首次官宣);2026-01 CES 首次公开亮相;2026-04 家族全新阵容发布 |
| 量产/上市 | 2025-01 流片成功;2026-01 通过美国出口审查;2026 年下半年启动量产装车(已获多个定点,首批车型预计 2026 年内量产) |
⚠️ 重要规格说明与不确定性(待官方确认)
- 算力口径分歧:2026 年 4 月官方家族阵容明确为 200 / 400 / 700 / 1000 TOPS 等效算力四档。但百度百科"华山A2000"词条基于 CES 2026 报道,将 A2000 单品算力记为 200 TOPS、能效比 3 TOPS/W(这实际对应家族中的入门档,即后来的 A2000N);另有 2023 年早期券商研报将"华山二号 A2000"描述为"国内首个 250T 大算力芯片、满足 ASIL-B"。这些数字来自不同时间点的产品规划,不应混用。本卡以 2026-04 官方家族阵容为准。
- 命名变更:2024-12 首次官宣时为 A2000 Lite / A2000 / A2000 Pro;2026-04 更新为 A2000N / A2000L / A2000U / A2000X。两套命名的对应关系官方未逐一说明,推测 Lite≈N、A2000≈L/U、Pro≈X,待官方确认。
- "等效算力"而非物理 TOPS:官方使用"等效算力"表述,强调九韶架构在同等物理算力下的更高有效吞吐,因此该数值不宜与竞品的物理峰值 TOPS 直接横向比较。
- 功耗、内存类型与带宽、晶体管数、CPU 核数均未逐档公开,本卡一律标注"未公开"或注明为推算值。
家族型号(2026-04 官方阵容)
| 型号 | 等效算力 | 定位 | 典型方案 |
|---|---|---|---|
| A2000N | 200 TOPS | 助力座舱 AI 化 / 轻量化辅助驾驶 | 座舱 AI Box,高性能大模型推理 |
| A2000L | 400 TOPS | 高性价比城市 NOA 芯片 | 多传感器融合城市 NOA |
| A2000U | 700 TOPS | 全场景通识智驾芯片(新一代算力平台) | 基于 AI 新范式的"聪明"辅助驾驶系统 |
| A2000X | 1000 TOPS | 高阶全场景通识智驾(旗舰级算力平台) | 拟人化 AI 司机、L3 级自动驾驶、Robotaxi |
关键特性
- 九韶 NPU 大核架构:物理 Unique AI 运算设计,无核间同步开销,模型可直接运行,避免传统多核架构的同步损耗,实现高有效算力
- 全链路混合精度免量化:原生支持 INT4/INT8/FP8/FP16/FP32,FP16 模型无需量化直跑,规避量化精度损失;原生支持随机舍入
- 近存计算 + 三层内存架构:8 TB/s 带宽的百 MB 级 NPU 专用片上缓存,数据无需频繁搬移至外部内存,大幅降低延迟与功耗
- Transformer / VLA / 世界模型专项优化:对 reshape/transpose/grid_sample 等非计算算子硬加速,调整指数单元与 MAC 单元配比
- "3L" 三层隔离安全架构:L1 高性能计算域(ASIL-B)/ L2 确定性安全域(ASIL-D 双核锁步、独立时钟电源)/ L3 硬隔离独立安全域(逻辑独立性比肩外置 MCU),L2↔L3 可动态切换"极致安全模式"与"高度协同模式",整体 ASIL-D
- 业界最高性能自研 ISP:4 曝光、150dB HDR,逆光/夜间/雨雪炫光等极限环境稳定成像,RAW 直通 NPU
- 芯片间高速一致性互联:可扩展支撑 L4 级 >2000 TOPS 算力需求与长期算力演进
- 通过美国 BIS 出口审查:历时 11 个月于 2025 年底获批,可利用海外先进制程产能,规避国内 7nm 车规产能瓶颈
- BaRT 工具链:基于 MLIR,原生兼容 PyTorch 推理 API,支持 Triton 自定义算子自动化编译、分钟级编译;曾 10 天完成首个模型部署
- FAD2.0 开放平台:以 A2000 高算力计算板为核心,开放 Linux 内核与驱动源码(含实时性补丁)、集成 Classic AUTOSAR 与 Hypervisor+RTOS,桌面级 + 车规级双接口
- CES 2026 最佳半导体产品奖
厂商信息
| 项目 | 内容 |
|---|---|
| 公司 | 黑芝麻智能科技有限公司(Black Sesame Technologies,港股 02533.HK) |
| 总部 | 中国 上海(硅谷、成都、深圳、武汉、重庆、新加坡设办事处) |
| 成立 | 2016 年 |
| 创始人 / CEO | 单记章 |
| 核心自研 IP | 九韶 NPU、星眸 / NeuralIQ ISP |
| 产品线 | 华山系列(A500 / A1000 / A1000L / A1000 Pro / A2000 家族)、武当系列(跨域)、SESAMEX 具身智能计算平台 |
| 合作进展 | 已与国内销量前六大车企中的五家深度合作;比亚迪等有望 2026 年批量装车;与国汽智控、Nullmax、美的(美创希)、正行创新等合作 |
| 经营数据 | 2025 年业务增长超 75%;2026 年全年芯片出货目标远超 1000 万颗 |
| 官网 | https://www.blacksesame.com.cn |
适用场景
- ✅ L3 级自动驾驶与 Robotaxi 级 L4(A2000X 单芯片 / 多芯片互联)
- ✅ 城区 NOA 城市领航辅助(A2000L 高性价比档)
- ✅ 端侧 VLA / VLM / 世界模型 / 一段式端到端大模型实时推理
- ✅ 座舱 AI Box 与舱驾融合(A2000N)
- ✅ 具身智能 / 机器人端侧算力(SESAMEX 平台,泛 AI 端侧)
- ✅ ASIL-D 功能安全要求的高阶智驾平台
- ✅ 24 路摄像头 + 多传感器融合的重感知方案
- ✅ FP16 免量化部署、快速模型迁移(PyTorch 原生 API)
- ❌ 数据中心大模型训练(车规端侧推理架构,性能密度与集群互联均非为此设计)
- ❌ 大规模 AI 训练集群组网(互联带宽定位于车内多芯协同)
- ❌ 低成本入门 ADAS(应选 A1000L / A1000 或 6B 级方案)
- ❌ 需要 FP64 高精度科学计算的场景
相关卡
- 黑芝麻 华山 A1000 — 同厂商上一代,16nm / 58 TOPS,A2000 的代际前身
- 地平线 征程6 (Journey 6) — 国产最直接竞品,7nm / 560 TOPS 纳什架构,同为舱驾一体 + 端到端定位
- 地平线 征程5 (Journey 5) — 国产上一代大算力智驾芯片,128 TOPS
- NVIDIA DRIVE Thor — 国际旗舰车规平台,A2000X 的主要国际对标对象
- Moore Threads MTT S5000 — 国产数据中心 GPU,与 A2000 构成"云端训练 + 车端推理"算力对照