NVIDIA L4 24GB GDDR6 7680个CUDA核心 30.3 TFLOPS单精度算力

NVIDIA L4 24GB GDDR6 7680个CUDA核心 30.3 TFLOPS单精度算力

Ada架构低功耗全能推理卡,24GB GDDR6显存,7680个CUDA核心,FP32算力30.3 TFLOPS,FP8张量121 TFLOPS,72W单槽半高设计。
产品描述

NVIDIA L4NVIDIA Ada Lovelace架构的低功耗全能加速卡,72W功耗下即可提供30.3 TFLOPS算力与FP8推理加速能力,24GB大显存配合Transformer引擎专门优化大模型推理,是替代T4的新一代视频、推理与图形三栖数据中心GPU



核心规格(引用NVIDIA官方参数)

GPU架构Ada Lovelace(AD104)
制程工艺台积电4N定制工艺
显存容量24GB GDDR6
显存位宽192-bit
显存带宽300 GB/s
CUDA核心数量7680个
Tensor核心240个(第四代Tensor核心)
RT核心60个(第三代RT核心)
单精度算力(FP32)30.3 TFLOPS
张量/推理性能FP8张量计算121 TFLOPS(稀疏242 TFLOPS)
功耗(TDP)72W
总线接口PCIe 4.0 x16(免供电)
外形与散热单槽半高(Low Profile),被动散热
显示输出无原生输出(mDP可选)
配套软件生态CUDA / TensorRT / AI Enterprise


架构与技术特点

Ada Lovelace架构基于台积电4N定制工艺,SM内部大幅增加L2缓存容量以降低显存访问压力;第四代Tensor Core支持FP8低精度格式,配合Transformer Engine显著加速大模型推理;第三代RT Core引入不透明度微映射(OMM)与着色器执行重排序(SER)技术,光追效率成倍提升;集成AV1双编码器,视频编解码吞吐量翻倍。

L4的第四代Tensor Core原生支持FP8低精度格式,配合Transformer Engine可将大语言模型与视觉Transformer的推理吞吐量提升数倍;双NVENC编码器支持AV1硬编码,视频转码效率较T4翻倍提升。半高单槽免供电设计使其成为边缘机柜、托管机房改造的首选升级方案。



典型应用场景

  • 大模型推理部署:LLM、多模态模型的FP8/FP16量化推理
  • 视频转码与处理:AV1/H.265多路实时转码,直播推流
  • 视觉AI推理:检测、分割、OCR等生产级模型服务
  • 云图形与轻量渲染:配合vGPU提供图形加速能力
  • 边缘数据中心与5G MEC节点


NVIDIA L4以Ada架构的能效革命,重新定义了低功耗数据中心GPU的性能标准,是T4用户的天然升级路径。我们提供原装正品货源与整机集成方案。






如果您想要了解该产品,请联系我们,联系方式gx80cn@gmail.com,18915339688

关于我们
扫一扫,关注我们最新消息扫一扫,关注我们最新消息
联系我们
025-66073091

工作时间:周一至周五 9:00-18:00

联系人:不是英伟达

手机:18915339688

NVIDIA CN
本站不是英伟达公司网站,以NV全系列产品为核心,聚焦NV旗下各类硬件、软件及解决方案的全面、深度介绍,致力于为广大用户打造一个专业、易懂的NV产品信息聚合平台。

无论是深耕行业的专业从业者、追求极致体验的硬件爱好者,还是初次接触NV产品的新手用户,都能在这里获取实用的产品资讯,解锁NV科技的核心魅力。
NVIDIACN 版权所有 -