GPU Hub: Local LLM Hardware Overview
Each GPU page includes specs, commentary from an LLM-inference perspective, value metrics (bandwidth per dollar, VRAM per dollar), and a verdict matrix with theoretical speed for 14 mainstream models at Q4_K_M @8K. Used price is preferred; MSRP is shown when no used price exists.
| GPU | VRAM | Bandwidth | Reference price | Bandwidth per $ |
|---|---|---|---|---|
| H100 80GB | 80 GB | 3350 GB/s | $30,000 | 0.11 |
| A100 80GB | 80 GB | 2039 GB/s | $15,000 | 0.14 |
| RTX 5090 | 32 GB | 1792 GB/s | $1,999 | 0.90 |
| RTX 4090 | 24 GB | 1008 GB/s | $2,400vs last month +118% | 0.42 |
| RX 7900 XTX | 24 GB | 960 GB/s | $650 | 1.48 |
| RTX 3090 | 24 GB | 936 GB/s | $1,100vs last month +10% | 0.85 |
| Mac Studio M3 Ultra (96GB) | 96 GB* | 819 GB/s | $5,299 | 0.15 |
| RTX A6000 | 48 GB | 768 GB/s | $2,800 | 0.27 |
| RTX 4070 Ti Super | 16 GB | 672 GB/s | $760vs last month +38% | 0.88 |
| Mac Studio M4 Max (64GB) | 64 GB* | 546 GB/s | $2,899 | 0.19 |
| RTX 3060 12GB | 12 GB | 360 GB/s | $260vs last month +44% | 1.38 |
| Mac mini M4 Pro (48GB) | 48 GB* | 273 GB/s | $1,799 | 0.15 |
Apple unified memory is counted at 75% usable for models (the rest serves the system/display).
Data verified 2026-09-01