产品

产品中心


undefined
+
  • undefined

A100

NVIDIA A100 Tensor Core GPU在各种规模上提供了前所未有的加速,为世界上性能最高的弹性数据中心提供了动力,用于人工智能、数据分析和高性能计算(HPC)应用。作为NVIDIA数据中心平台的引擎,A100的性能比上一代NVIDIA Volta™高出20倍。A100可以使用多实例GPU(MIG)有效地扩展或划分为七个独立的GPU实例,提供一个统一的平台,使弹性数据中心能够动态调整以适应不断变化的工作负载需求。

所属分类: A100

关键词 : A100


适用于各种工作负载的最强大的计算平台

NVIDIA A100张量核心GPU规范(SXM4和PCIE形状因子)

NVIDIA A100 Tensor Core GPU在各种规模上提供了前所未有的加速,为世界上性能最高的弹性数据中心提供了动力,用于人工智能、数据分析和高性能计算(HPC)应用。作为NVIDIA数据中心平台的引擎,A100的性能比上一代NVIDIA Volta™高出20倍。A100可以使用多实例GPU(MIG)有效地扩展或划分为七个独立的GPU实例,提供一个统一的平台,使弹性数据中心能够动态调整以适应不断变化的工作负载需求。
NVIDIA A100 Tensor Core技术支持广泛的数学精度,为每种工作负载提供单一的加速器。最新一代A100 80GB将GPU内存增加了一倍,并以2 TB每秒(TB/s)的速度首次推出了世界上最快的内存带宽,加快了最大型号和最海量数据集的解决方案时间。
A100是完整的NVIDIA数据中心解决方案的一部分,该解决方案集成了NVIDIA NGC™目录中硬件、网络、软件、库以及优化的人工智能模型和应用程序的构建块。它代表了数据中心最强大的端到端人工智能和HPC平台,使研究人员能够提供真实世界的结果,并将解决方案大规模部署到生产中。

 

A100
80GB PCIe
A100
80GB SXM
FP64
9.7 TFLOPS
FP64 Tensor Core
19.5 TFLOPS
FP32
19.5 TFLOPS
Tensor Float 32 (TF32)
156 TFLOPS|312 TFLOPS*
BFLOAT16 Tensor Core
312 TFLOPS|624 TFLOPS*
FP16 Tensor Core
312 TFLOPS|624 TFLOPS*
INT8 Tensor Core
624 TOPS|1248 TOPS*
GPU Memory
80GB HBM2e
80GB HBM2e
GPU Memory Bandwidth
1,935GB/s
2,039GB/s
Max Thermal Design Power (TDP)
300W
400W***
Multi-Instance GPU
Up to 7 MIGs @ 10GB
Up to 7 MIGs @ 10GB
Form Factor
PCIe
dual-slot air cooled or
single-slot liquid cooled
SXM
Interconnect
NVIDIA® NVLink® Bridge
for 2 GPUs: 600GB/s **
PCIe Gen4: 64GB/s
NVLink: 600GB/s
PCIe Gen4: 64GB/s
Server Options
Partner and NVIDIA-
Certifed Systems™
with 1-8 GPUs
NVIDIA HGX™ A100-
Partner and NVIDIA-
Certifed Systems with
4,8, or 16 GPUs
NVIDIA DGX™ A100
with 8 GPUs

跨工作负载提高性能

 

NVIDIA A100 Tensor Core GPU是用于深度学习、HPC和数据分析的NVIDIA数据中心平台的旗舰产品。该平台加速了2000多个应用程序,包括每一个主要的深度学习框架。A100无处不在,从台式机到服务器再到云服务,提供了显著的性能提升和成本节约机会。

在线留言

提交