NVIDIA A100 Tensor Core GPU(40GB / 80GB)

 提示:点击图片可以放大

NVIDIA A100 是 Ampere 架构数据中心旗舰 GPU,提供 40GB 与 80GB HBM2e 两种规格,凭借第三代 Tensor Core、MIG 多实例切分与 NVLink 互联,成为全球 AI 训练集群部署量最大的加速卡之一。

核心规格:

  • CUDA 核心:6912(Ampere 架构)
  • Tensor 核心:432 个(第三代)
  • 显存:40GB HBM2(1555 GB/s)/ 80GB HBM2e(2039 GB/s)
  • 性能:FP64 9.7 / 19.5 TFLOPS,TF32 Tensor 156 TFLOPS(稀疏 312),INT8 624 TOPS(稀疏 1248)
  • 互联:NVLink 600 GB/s(第三代),支持多卡全互联
  • 功耗:400W(SXM4)/ 250W(PCIe),被动散热
  • 特性:MIG 最多切分 7 个独立 GPU 实例,支持多实例 vGPU

A100 支撑了大规模预训练模型与推荐系统的发展,目前仍是大量智算中心与云厂商 AI 实例的核心算力底座,与 H100/H800 共同构成主力供给。