Skip to main content

NVIDIA L20 (Ada 推理加速)

产品概述

NVIDIA L20 是 Ada Lovelace 架构的数据中心推理卡,定位介于 L4 与 L40S 之间。48GB GDDR6 ECC 显存、239 TFLOPS FP8 稀疏算力、275W TDP,是面向生成式 AI 与 LLM 推理的主流 PCIe 加速卡,国内大模型推理场景中与 H20 并列为热门选择。

基于完整 AD102 核心(11,776 CUDA 核心),支持 MIG、vGPU 与结构化稀疏,兼顾 AI 推理、3D 图形和视频处理。

核心规格

项目参数
架构Ada Lovelace (AD102)
制程TSMC 4N
CUDA 核心11,776
Tensor 核心368(第四代)
RT 核心92(第三代)
显存48 GB GDDR6 ECC
显存带宽864 GB/s
L2 缓存96 MB
FP3259.8 TFLOPS
FP16 Tensor119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏)
BF16 Tensor119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏)
FP8 Tensor119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏)
INT8 Tensor119.5 TOPS(密集)/ 239 TOPS(稀疏)
TDP275 W
接口PCIe Gen4 ×16(64 GB/s)
形态2 槽 FHFL,被动散热
视频引擎3× NVENC(含 AV1)+ 3× NVDEC + 4× NVJPEG
MIG支持(1g/2g/4g 实例)
首发2023-Q4
价格$4,500(市场价,无官方 MSRP)

L20 vs L4 vs L40S 对比

指标L20L4L40S
架构Ada AD102Ada AD104Ada AD102
CUDA 核心11,7767,68018,176
显存48GB GDDR6 ECC24GB GDDR648GB GDDR6 ECC
带宽864 GB/s300 GB/s864 GB/s
FP8 Tensor(稀疏)239 TFLOPS485 TFLOPS733 TFLOPS
FP3259.8 TFLOPS30.3 TFLOPS91.6 TFLOPS
TDP275W72W350W
定位大模型推理低功耗推理推理+渲染全能

L20 显存与 L40S 持平(48GB)、带宽相同,但 FP8 稀疏算力仅为 L40S 的 33%;功耗低 75W,价格约便宜一半,是性价比导向的 LLM 推理选择。

适用场景

  • LLM / 生成式 AI 推理(70B 级模型量化部署)
  • ✅ 多实例推理(MIG 切分,多租户共享)
  • ✅ 企业级 vGPU 虚拟化(vPC/vWS)
  • ✅ 3D 渲染与视频转码(NVENC AV1)
  • ✅ 科学计算 / 数据科学(FP32 + Tensor)
  • ❌ 大规模训练(应使用 H100/B200)
  • ❌ 超低功耗边缘部署(应使用 L4/T4)

厂商信息

项目内容
厂商NVIDIA
目标市场数据中心 AI 推理、生成式 AI
价格$4,000-$6,000(市场价,无官方 MSRP)

相关卡