NVIDIA Ampere
Mainstream (2020-2022)
Ampere GPU Family
NVIDIA Ampere is the most widely-deployed AI GPU architecture in the cloud. Featuring HBM2e memory, MIG (Multi-Instance GPU) support, and NVLink 3 interconnects, the A100 remains a workhorse for AI training and inference.
12 GPU models in this family
GPU Comparison
| GPU Model | VRAM | Bandwidth | Interconnect | Best For | Starting Price | TDP | Year | |
|---|---|---|---|---|---|---|---|---|
| A10 PCIe Gen4 | 24 GB GDDR6 | 600 GB/s | PCIe Gen4 (64 GB/s) | AI inference | — | 150W | 2021 | View |
| A100 NVLink PCIe Gen4 (with NVLink bridge) | 80 GB HBM2e | 2.0 TB/s | NVLink 3 (600 GB/s) via NVLink bridge | AI training | $50.50/hr | 300W | 2021 | View |
| A100 PCIe PCIe Gen4 (no NVLink) | 80 GB HBM2e | 2.0 TB/s | PCIe Gen4 (64 GB/s) — no NVLink | AI inference | $50.50/hr | 300W | 2021 | View |
| A100 SXM 80GB SXM4 | 80 GB HBM2e | 2.0 TB/s | NVLink 3 (600 GB/s) | AI training | $50.50/hr | 400W | 2021 | View |
| A16 PCIe Gen4 | 64 GB GDDR6 (16 GB × 4 GPUs) | TBD | PCIe Gen4 | VDI | — | 250W | 2021 | View |
| A2 PCIe Gen4 (single-slot, passive) | 16 GB GDDR6 | 200 GB/s | PCIe Gen4 (64 GB/s) | AI inference (light) | — | 40-60W | 2021 | View |
| A30 PCIe Gen4 | 24 GB HBM2 | 933 GB/s | NVLink 3 (600 GB/s) | AI training (small models) | — | 165W | 2021 | View |
| RTX A4000 PCIe Gen4 (single-slot) | 16 GB GDDR6 | 448 GB/s | PCIe Gen4 (64 GB/s) | Workstation AI | — | 140W | 2021 | View |
| RTX A5000 PCIe Gen4 | 24 GB GDDR6 | 768 GB/s | PCIe Gen4 (64 GB/s) | Workstation AI | — | 230W | 2021 | View |
| A100 SXM 40GB SXM4 | 40 GB HBM2e | 1.55 TB/s | NVLink 3 (600 GB/s) | AI training | $50.50/hr | 400W | 2020 | View |
| A40 PCIe Gen4 | 48 GB GDDR6 | 696 GB/s | PCIe Gen4 (64 GB/s) | Graphics | — | 300W | 2020 | View |
| RTX A6000 PCIe Gen4 | 48 GB GDDR6 | 768 GB/s | PCIe Gen4 (64 GB/s) / NVLink Bridge | Workstation AI | — | 300W | 2020 | View |