NVIDIA L20 (Ada 推理加速)
产品概述
NVIDIA L20 是 Ada Lovelace 架构的数据中心推理卡,定位介于 L4 与 L40S 之间。48GB GDDR6 ECC 显存、239 TFLOPS FP8 稀疏算力、275W TDP,是面向生成式 AI 与 LLM 推理的主流 PCIe 加速卡,国内大模型推理场景中与 H20 并列为热门选择。
基于完整 AD102 核心(11,776 CUDA 核心),支持 MIG、vGPU 与结构化稀疏,兼顾 AI 推理、3D 图形和视频处理。
核心规格
| 项目 | 参数 |
|---|---|
| 架构 | Ada Lovelace (AD102) |
| 制程 | TSMC 4N |
| CUDA 核心 | 11,776 |
| Tensor 核心 | 368(第四代) |
| RT 核心 | 92(第三代) |
| 显存 | 48 GB GDDR6 ECC |
| 显存带宽 | 864 GB/s |
| L2 缓存 | 96 MB |
| FP32 | 59.8 TFLOPS |
| FP16 Tensor | 119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏) |
| BF16 Tensor | 119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏) |
| FP8 Tensor | 119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏) |
| INT8 Tensor | 119.5 TOPS(密集)/ 239 TOPS(稀疏) |
| TDP | 275 W |
| 接口 | PCIe Gen4 ×16(64 GB/s) |
| 形态 | 2 槽 FHFL,被动散热 |
| 视频引擎 | 3× NVENC(含 AV1)+ 3× NVDEC + 4× NVJPEG |
| MIG | 支持(1g/2g/4g 实例) |
| 首发 | 2023-Q4 |
| 价格 | $4,500(市场价,无官方 MSRP) |
L20 vs L4 vs L40S 对比
| 指标 | L20 | L4 | L40S |
|---|---|---|---|
| 架构 | Ada AD102 | Ada AD104 | Ada AD102 |
| CUDA 核心 | 11,776 | 7,680 | 18,176 |
| 显存 | 48GB GDDR6 ECC | 24GB GDDR6 | 48GB GDDR6 ECC |
| 带宽 | 864 GB/s | 300 GB/s | 864 GB/s |
| FP8 Tensor(稀疏) | 239 TFLOPS | 485 TFLOPS | 733 TFLOPS |
| FP32 | 59.8 TFLOPS | 30.3 TFLOPS | 91.6 TFLOPS |
| TDP | 275W | 72W | 350W |
| 定位 | 大模型推理 | 低功耗推理 | 推理+渲染全能 |
L20 显存与 L40S 持平(48GB)、带宽相同,但 FP8 稀疏算力仅为 L40S 的 33%;功耗低 75W,价格约便宜一半,是性价比导向的 LLM 推理选择。
适用场景
- ✅ LLM / 生成式 AI 推理(70B 级模型量化部署)
- ✅ 多实例推理(MIG 切分,多租户共享)
- ✅ 企业级 vGPU 虚拟化(vPC/vWS)
- ✅ 3D 渲染与视频转码(NVENC AV1)
- ✅ 科学计算 / 数据科学(FP32 + Tensor)
- ❌ 大规模训练(应使用 H100/B200)
- ❌ 超低功耗边缘部署(应使用 L4/T4)
厂商信息
| 项目 | 内容 |
|---|---|
| 厂商 | NVIDIA |
| 目标市场 | 数据中心 AI 推理、生成式 AI |
| 价格 | $4,000-$6,000(市场价,无官方 MSRP) |
相关卡
- NVIDIA L4 - 低功耗推理
- NVIDIA L40S - 推理+渲染全能
- NVIDIA H20 - 国内特供大显存推理
- NVIDIA A100 - 前代数据中心训练