产品概述
NVIDIA A800 是 NVIDIA 为应对美国对华出口管制而推出的 A100 中国特供降速版,于 2022 年发布。两者核心算力几乎完全一致,唯一区别在于 NVLink 互联带宽从 600 GB/s 降至 400 GB/s。在单卡训练/推理场景下性能与 A100 完全相同,仅在大规模集群(16 卡以上)互联密集训练中效率略有下降。
战略地位:在 A100 无法通过正规渠道入华后,A800 成为国内大模型训练的主力算力之一,长期稳定供货,是 2022-2023 年国内智算中心的主流选择(后续被 H800、昇腾 910B 等逐步替代)。
核心规格
| 项目 | 参数 |
|---|
| 架构 | NVIDIA Ampere (GA100) |
| 制程 | TSMC 7nm |
| CUDA 核心 | 6,912 |
| Tensor Core | 432(第三代) |
| FP16 算力 | 312 TFLOPS |
| FP32 | 19.5 TFLOPS |
| INT8 算力 | 624 TOPS |
| 显存 | 80 GB HBM2e |
| 显存类型 | HBM2e |
| 显存带宽 | 2.0 TB/s |
| NVLink 带宽 | 400 GB/s(A100 为 600 GB/s) |
| PCIe | Gen 4.0 x16 |
| TDP | 400 W |
| 发布时间 | 2022 年 |
| 价格 | 约 ¥10.4 万 – ¥14 万(中国市场) |
与 A100 对比
| 指标 | A800 80GB | A100 80GB | 差异 |
|---|
| 架构 | Ampere | Ampere | 一致 |
| 显存 | 80GB HBM2e | 80GB HBM2e | 一致 |
| 带宽 | 2.0 TB/s | 2.0 TB/s | 一致 |
| FP16 | 312 TFLOPS | 312 TFLOPS | 一致 |
| NVLink | 400 GB/s | 600 GB/s | 降速 33% |
| PCIe | Gen 4.0 | Gen 4.0 | 一致 |
| TDP | 400 W | 400 W | 一致 |
关键特性
- 算力与 A100 一致:单卡训练/推理零差异
- NVLink 降速:仅影响大规模集群互联密集场景(8 卡效率降 10-15%,16 卡+ 降 20-30%)
- 合规供货:国内可正常采购,长期供应稳定
- 生态完整:CUDA / cuDNN / NCCL 全栈兼容
厂商信息
适用场景
- ✅ 大模型训练(单卡/小规模集群)
- ✅ AI 推理
- ✅ HPC 科学计算
- ⚠️ 超大规模集群(NVLink 降速影响互联效率)
相关产品对比
外部链接