产品展示
+
A100
NVIDIA A100 Tensor Core GPU在各种规模上提供了前所未有的加速,为世界上性能最高的弹性数据中心提供了动力,用于人工智能、数据分析和高性能计算(HPC)应用。作为NVIDIA数据中心平台的引擎,A100的性能比上一代NVIDIA Volta™高出20倍。A100可以使用多实例GPU(MIG)有效地扩展或划分为七个独立的GPU实例,提供一个统一的平台,使弹性数据中心能够动态调整以适应不断变化的工作负载需求。
关键词 : A100
适用于各种工作负载的最强大的计算平台
NVIDIA A100张量核心GPU规范(SXM4和PCIE形状因子)
NVIDIA A100 Tensor Core GPU在各种规模上提供了前所未有的加速,为世界上性能最高的弹性数据中心提供了动力,用于人工智能、数据分析和高性能计算(HPC)应用。作为NVIDIA数据中心平台的引擎,A100的性能比上一代NVIDIA Volta™高出20倍。A100可以使用多实例GPU(MIG)有效地扩展或划分为七个独立的GPU实例,提供一个统一的平台,使弹性数据中心能够动态调整以适应不断变化的工作负载需求。
NVIDIA A100 Tensor Core技术支持广泛的数学精度,为每种工作负载提供单一的加速器。最新一代A100 80GB将GPU内存增加了一倍,并以2 TB每秒(TB/s)的速度首次推出了世界上最快的内存带宽,加快了最大型号和最海量数据集的解决方案时间。
A100是完整的NVIDIA数据中心解决方案的一部分,该解决方案集成了NVIDIA NGC™目录中硬件、网络、软件、库以及优化的人工智能模型和应用程序的构建块。它代表了数据中心最强大的端到端人工智能和HPC平台,使研究人员能够提供真实世界的结果,并将解决方案大规模部署到生产中。
| A100 80GB PCIe | A100 80GB SXM |
FP64 | 9.7 TFLOPS | |
FP64 Tensor Core | 19.5 TFLOPS | |
FP32 | 19.5 TFLOPS | |
Tensor Float 32 (TF32) | 156 TFLOPS|312 TFLOPS* | |
BFLOAT16 Tensor Core | 312 TFLOPS|624 TFLOPS* | |
FP16 Tensor Core | 312 TFLOPS|624 TFLOPS* | |
INT8 Tensor Core | 624 TOPS|1248 TOPS* | |
GPU Memory | 80GB HBM2e | 80GB HBM2e |
GPU Memory Bandwidth | 1,935GB/s | 2,039GB/s |
Max Thermal Design Power (TDP) | 300W | 400W*** |
Multi-Instance GPU | Up to 7 MIGs @ 10GB | Up to 7 MIGs @ 10GB |
Form Factor | PCIe dual-slot air cooled or single-slot liquid cooled | SXM |
Interconnect | NVIDIA® NVLink® Bridge for 2 GPUs: 600GB/s ** PCIe Gen4: 64GB/s | NVLink: 600GB/s PCIe Gen4: 64GB/s |
Server Options | Partner and NVIDIA- Certifed Systems™ with 1-8 GPUs | NVIDIA HGX™ A100- Partner and NVIDIA- Certifed Systems with 4,8, or 16 GPUs NVIDIA DGX™ A100 with 8 GPUs |
跨工作负载提高性能
NVIDIA A100 Tensor Core GPU是用于深度学习、HPC和数据分析的NVIDIA数据中心平台的旗舰产品。该平台加速了2000多个应用程序,包括每一个主要的深度学习框架。A100无处不在,从台式机到服务器再到云服务,提供了显著的性能提升和成本节约机会。