跳到主要内容

NVIDIA L20 (Ada 推理加速)

产品概述​

NVIDIA L20 是 Ada Lovelace 架构的数据中心推理卡,定位介于 L4 与 L40S 之间。48GB GDDR6 ECC 显存、239 TFLOPS FP8 稀疏算力、275W TDP,是面向生成式 AI 与 LLM 推理的主流 PCIe 加速卡,国内大模型推理场景中与 H20 并列为热门选择。

基于完整 AD102 核心(11,776 CUDA 核心),支持 MIG、vGPU 与结构化稀疏,兼顾 AI 推理、3D 图形和视频处理。

核心规格​

项目参数
架构Ada Lovelace (AD102)
制程TSMC 4N
CUDA 核心11,776
Tensor 核心368(第四代)
RT 核心92(第三代)
显存48 GB GDDR6 ECC
显存带宽864 GB/s
L2 缓存96 MB
FP3259.8 TFLOPS
FP16 Tensor119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏)
BF16 Tensor119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏)
FP8 Tensor119.5 TFLOPS(密集)/ 239 TFLOPS(稀疏)
INT8 Tensor119.5 TOPS(密集)/ 239 TOPS(稀疏)
TDP275 W
接口PCIe Gen4 ×16(64 GB/s)
形态2 槽 FHFL,被动散热
视频引擎3× NVENC(含 AV1)+ 3× NVDEC + 4× NVJPEG
MIG支持(1g/2g/4g 实例)
首发2023-Q4
价格$4,500(市场价,无官方 MSRP)

L20 vs L4 vs L40S 对比​

指标L20L4L40S
架构Ada AD102Ada AD104Ada AD102
CUDA 核心11,7767,68018,176
显存48GB GDDR6 ECC24GB GDDR648GB GDDR6 ECC
带宽864 GB/s300 GB/s864 GB/s
FP8 Tensor(稀疏)239 TFLOPS485 TFLOPS733 TFLOPS
FP3259.8 TFLOPS30.3 TFLOPS91.6 TFLOPS
TDP275W72W350W
定位大模型推理低功耗推理推理+渲染全能

L20 显存与 L40S 持平(48GB)、带宽相同,但 FP8 稀疏算力仅为 L40S 的 33%;功耗低 75W,价格约便宜一半,是性价比导向的 LLM 推理选择。

适用场景​

  • ✅ LLM / 生成式 AI 推理(70B 级模型量化部署)
  • ✅ 多实例推理(MIG 切分,多租户共享)
  • ✅ 企业级 vGPU 虚拟化(vPC/vWS)
  • ✅ 3D 渲染与视频转码(NVENC AV1)
  • ✅ 科学计算 / 数据科学(FP32 + Tensor)
  • ❌ 大规模训练(应使用 H100/B200)
  • ❌ 超低功耗边缘部署(应使用 L4/T4)

厂商信息​

项目内容
厂商NVIDIA
目标市场数据中心 AI 推理、生成式 AI
价格$4,000-$6,000(市场价,无官方 MSRP)

相关卡​