GPU specs for AI / ML

VRAM, memory bandwidth, and tensor/matrix-core compute for GPUs actually used to train and run AI models — cross-linked to which CUDA and ROCm versions each one supports.

→ Compare GPUs side by side

GPUReleasedVendorCategoryArchitectureCUs / SMsVRAMBandwidthFP16/BF16 TFLOPSINT8 TOPSTDP
Instinct MI455X2026AMDdatacenterCDNA 5256432 GB23,300 GB/s5,0005,000—
Instinct MI350X2025AMDdatacenterCDNA 4256288 GB8,000 GB/s2,309.64,6001000 W
Instinct MI355X2025AMDdatacenterCDNA 4256288 GB8,000 GB/s2,516.65,0001400 W
Radeon AI PRO R97002025AMDworkstationRDNA 46432 GB640 GB/s191383300 W
Radeon RX 9060 XT (8GB)2025AMDconsumerRDNA 4328 GB320 GB/s103205150 W
Radeon RX 9060 XT (16GB)2025AMDconsumerRDNA 43216 GB320 GB/s103205160 W
Radeon RX 90702025AMDconsumerRDNA 45616 GB640 GB/s145289220 W
Radeon RX 9070 XT2025AMDconsumerRDNA 46416 GB640 GB/s195389304 W
Instinct MI325X2024AMDdatacenterCDNA 3304256 GB6,000 GB/s1,307.42,6001000 W
Radeon RX 7600 XT2024AMDconsumerRDNA 33216 GB288 GB/s45.145.1190 W
Instinct MI300A2023AMDdatacenterCDNA 3228128 GB5,300 GB/s980.61,961550 W
Instinct MI300X2023AMDdatacenterCDNA 3304192 GB5,325 GB/s1,307.42,600750 W
Radeon RX 7700 XT2023AMDconsumerRDNA 35412 GB432 GB/s70.370.3245 W
Radeon RX 7800 XT2023AMDconsumerRDNA 36016 GB624 GB/s74.674.6263 W
Radeon RX 7900 GRE2023AMDconsumerRDNA 38016 GB576 GB/s9292260 W
Instinct MI2102022AMDdatacenterCDNA 210464 GB1,600 GB/s181181300 W
Radeon RX 6650 XT2022AMDconsumerRDNA 2328 GB280 GB/s——180 W
Radeon RX 6750 XT2022AMDconsumerRDNA 24012 GB432 GB/s——250 W
Radeon RX 6950 XT2022AMDconsumerRDNA 28016 GB576 GB/s——335 W
Radeon RX 7900 XT2022AMDconsumerRDNA 38420 GB800 GB/s103103315 W
Radeon RX 7900 XTX2022AMDconsumerRDNA 39624 GB960 GB/s123123355 W
Instinct MI250X2021AMDdatacenterCDNA 2220128 GB3,276.8 GB/s383383500 W
Radeon RX 66002021AMDconsumerRDNA 2288 GB224 GB/s——132 W
Radeon RX 6700 XT2021AMDconsumerRDNA 24012 GB384 GB/s——230 W
Instinct MI1002020AMDdatacenterCDNA 112032 GB1,200 GB/s184.692.3300 W
Radeon RX 68002020AMDconsumerRDNA 26016 GB512 GB/s——250 W
Radeon RX 6800 XT2020AMDconsumerRDNA 27216 GB512 GB/s——300 W
Radeon RX 6900 XT2020AMDconsumerRDNA 28016 GB512 GB/s——300 W
Radeon VII2019AMDconsumerGCN 5.1 (Vega 20)6016 GB1,024 GB/s——300 W
Radeon Instinct MI502018AMDdatacenterVega 7nm (GCN 5.1)6032 GB1,000 GB/s—53.6300 W
Radeon Instinct MI252017AMDdatacenterVega10 (GCN 5.0)6416 GB484 GB/s——300 W
Radeon Instinct MI62017AMDdatacenterPolaris (GCN 4)3616 GB224 GB/s——150 W
Radeon Instinct MI82017AMDdatacenterFiji (GCN 3)644 GB512 GB/s——175 W
Arc B5802024IntelconsumerXe2-HPG (Battlemage)2012 GB456 GB/s—233190 W
Data Center GPU Max 15502023InteldatacenterXe-HPC (Ponte Vecchio)128128 GB3,276.8 GB/s——600 W
Arc A3802022IntelconsumerXe-HPG (Alchemist)86 GB186 GB/s—6675 W
Arc A7502022IntelconsumerXe-HPG (Alchemist)288 GB512 GB/s—229225 W
Arc A770 (16GB)2022IntelconsumerXe-HPG (Alchemist)3216 GB560 GB/s—262225 W
B300 (Blackwell Ultra)2026NVIDIAdatacenterBlackwell Ultra160288 GB8,000 GB/s2,250—1400 W
RTX 50902025NVIDIAconsumerBlackwell17032 GB1,792 GB/s209.5838575 W
RTX PRO 6000 Blackwell2025NVIDIAworkstationBlackwell18896 GB1,792 GB/s2501,000600 W
B2002024NVIDIAdatacenterBlackwell148180 GB7,700 GB/s2,2504,5001000 W
H200 SXM 141GB2024NVIDIAdatacenterHopper132141 GB4,800 GB/s989.51,979700 W
L40S2023NVIDIAdatacenterAda Lovelace14248 GB864 GB/s362.05—350 W
H100 SXM5 80GB2022NVIDIAdatacenterHopper13280 GB3,350 GB/s989.51,979700 W
RTX 40902022NVIDIAconsumerAda Lovelace12824 GB1,008 GB/s165.2660.6450 W
RTX 6000 Ada Generation2022NVIDIAworkstationAda Lovelace14248 GB960 GB/s364.25—300 W
A100 SXM4 80GB2020NVIDIAdatacenterAmpere10880 GB2,039 GB/s312624400 W
RTX 30902020NVIDIAconsumerAmpere8224 GB936 GB/s71.2284.7350 W
T42018NVIDIAdatacenterTuring4016 GB300 GB/s6513070 W
TITAN RTX2018NVIDIAconsumerTuring7224 GB672 GB/s130—280 W
GTX 1080 Ti2017NVIDIAconsumerPascal2811 GB484 GB/s——250 W
TITAN V2017NVIDIAconsumerVolta8012 GB653 GB/s110—250 W
V100 SXM2 32GB2017NVIDIAdatacenterVolta8032 GB900 GB/s125—300 W
P100 SXM2 16GB2016NVIDIAdatacenterPascal5616 GB732 GB/s——300 W
TITAN X (Pascal)2016NVIDIAconsumerPascal2812 GB480 GB/s——250 W
M40 24GB2015NVIDIAdatacenterMaxwell2424 GB288 GB/s——250 W
K802014NVIDIAdatacenterKepler2624 GB480 GB/s——300 W
FP16/BF16 TFLOPS figures are dense (non-sparse) tensor/matrix-core throughput from each vendor's own spec sheets — real-world throughput depends on kernel, framework, and batch size. The CUs / SMs column counts each vendor's own top-level processing block (AMD Compute Units, NVIDIA Streaming Multiprocessors, Intel Xe-cores), which is not a like-for-like unit across vendors or generations. See each GPU's page for sourcing notes.