NVIDIA V100(Tesla V100)是 Volta 架构数据中心 GPU,首次引入 640 个 Tensor Core,以 16GB/32GB HBM2 显存和 NVLink 高速互联,开创了 GPU 深度学习训练的黄金时代,至今仍服务于大量存量 AI 训练与高性能计算集群。
核心规格:
- CUDA 核心:5120(Volta 架构)
- Tensor 核心:640 个(第一代)
- 显存:16GB / 32GB HBM2,带宽 900 GB/s
- 性能:FP64 7.8 TFLOPS,FP32 15.7 TFLOPS,深度学习 FP16 125 TFLOPS
- 互联:NVLink 300 GB/s,支持 2-8 卡互联
- 功耗:300W(SXM2 版本),被动散热,面向服务器平台
- 状态:已进入产品生命周期末期,后续由 A100 / H100 系列接替
V100 是 AI 产业化进程中的里程碑产品,曾支撑 ResNet、BERT、GPT 等经典模型训练,目前在推理与科研场景中仍有大量在网运行。
