跳到主要内容

NVIDIA A800

产品概述

NVIDIA A800 是 NVIDIA 为应对美国对华出口管制而推出的 A100 中国特供降速版,于 2022 年发布。两者核心算力几乎完全一致,唯一区别在于 NVLink 互联带宽从 600 GB/s 降至 400 GB/s。在单卡训练/推理场景下性能与 A100 完全相同,仅在大规模集群(16 卡以上)互联密集训练中效率略有下降。

战略地位:在 A100 无法通过正规渠道入华后,A800 成为国内大模型训练的主力算力之一,长期稳定供货,是 2022-2023 年国内智算中心的主流选择(后续被 H800、昇腾 910B 等逐步替代)。

核心规格

项目参数
架构NVIDIA Ampere (GA100)
制程TSMC 7nm
CUDA 核心6,912
Tensor Core432(第三代)
FP16 算力312 TFLOPS
FP3219.5 TFLOPS
INT8 算力624 TOPS
显存80 GB HBM2e
显存类型HBM2e
显存带宽2.0 TB/s
NVLink 带宽400 GB/s(A100 为 600 GB/s)
PCIeGen 4.0 x16
TDP400 W
发布时间2022 年
价格约 ¥10.4 万 – ¥14 万(中国市场)

与 A100 对比

指标A800 80GBA100 80GB差异
架构AmpereAmpere一致
显存80GB HBM2e80GB HBM2e一致
带宽2.0 TB/s2.0 TB/s一致
FP16312 TFLOPS312 TFLOPS一致
NVLink400 GB/s600 GB/s降速 33%
PCIeGen 4.0Gen 4.0一致
TDP400 W400 W一致

关键特性

  • 算力与 A100 一致:单卡训练/推理零差异
  • NVLink 降速:仅影响大规模集群互联密集场景(8 卡效率降 10-15%,16 卡+ 降 20-30%)
  • 合规供货:国内可正常采购,长期供应稳定
  • 生态完整:CUDA / cuDNN / NCCL 全栈兼容

厂商信息

项目内容
公司NVIDIA Corporation
官网https://www.nvidia.com
发布2022 年
架构Ampere

适用场景

  • 大模型训练(单卡/小规模集群)
  • AI 推理
  • HPC 科学计算
  • ⚠️ 超大规模集群(NVLink 降速影响互联效率)

相关产品对比

外部链接