NVIDIA Tesla T4:NVIDIA面向数据中心与边缘推理场景打造的低功耗单槽加速卡,在70W功耗预算内即可提供8.1 TFLOPS单精度算力与130 TOPS的INT8推理性能,凭借半高长度可灵活部署于1U/2U服务器及各类边缘计算设备,是视频转码、推理服务与虚拟桌面基础设施(VDI)的国民级选择
核心规格(引用NVIDIA官方参数)
| GPU架构 | Turing(TU104) |
| 制程工艺 | 12nm FFN |
| 显存容量 | 16GB GDDR6 |
| 显存位宽 | 256-bit |
| 显存带宽 | 320 GB/s |
| CUDA核心数量 | 2560个 |
| Tensor核心 | 320个(第二代Tensor核心) |
| RT核心 | 40个(第一代RT核心) |
| 单精度算力(FP32) | 8.1 TFLOPS |
| 张量/推理性能 | FP16张量计算65 TFLOPS,INT8推理130 TOPS |
| 功耗(TDP) | 70W |
| 总线接口 | PCIe 3.0 x16 |
| 外形与散热 | 单槽半高(Low Profile)被动散热 |
| 显示输出 | 3×DisplayPort 1.4 |
| 配套软件生态 | CUDA / TensorRT / NVIDIA AI Enterprise |
架构与技术特点
Turing架构在12nm制程上首次引入RT Core光线追踪核心与Tensor Core的混合渲染体系,同时采用独立的INT32与FP32执行流,单周期可并行处理整数与浮点指令,GDDR6显存与USH RT技术进一步提升了带宽利用率,兼具图形渲染与AI推理加速能力。
T4支持完整的NVIDIA AI推理软件栈,通过TensorRT可将训练好的模型量化为INT8/FP16部署,单卡即可承载多路视频流分析或多实例推理服务,多卡并行可平滑扩展吞吐量,配合MIG不存在但通过vGPU切分可支持多租户共享GPU资源。
典型应用场景
作为经受过大规模生产验证的推理加速卡,Tesla T4以极佳的能效比、广泛的整机兼容性和成熟的软件生态,至今仍是视频处理与中小规模推理集群的高性价比方案。我们提供原装正品渠道货源与批量采购支持,可为您搭配整机集成方案。
如果您想要了解该产品,请联系我们,联系方式gx80cn@gmail.com,18915339688
扫一扫,关注我们最新消息