What AI models run on 16 GB of VRAM?
25 of 49 image and video models run at 8-bit quality or better on 16 GB. Here is every one, with the file to download.
01Every model on 16 GB
| Model | Verdict | Best file | Size | Needed |
|---|---|---|---|---|
| image models | ||||
| FLUX.1 [dev] | Runs well | Q8_0 | 12.7 GB | 15.0 GB |
| FLUX.1 [schnell] | Runs well | Q8_0 | 12.7 GB | 15.0 GB |
| FLUX.1 Kontext [dev] | Runs well | Q8_0 | 12.7 GB | 15.3 GB |
| FLUX.1 Krea [dev] | Runs well | Q8_0 | 12.7 GB | 15.0 GB |
| FLUX.1 Fill [dev] | Runs well | Q8_0 | 12.7 GB | 15.3 GB |
| FLUX.2 [dev] | Offload only | Q2_K | 12.9 GB | 16.2 GB |
| FLUX.2 [klein] 9B | Runs well | Q8_0 | 10.0 GB | 12.3 GB |
| FLUX.2 [klein] 4B | Runs well | 16-bit | 7.8 GB | 9.6 GB |
| Krea 2 (Turbo) | Runs well | FP8 | 13.1 GB | 15.7 GB |
| Qwen-Image | Runs | Q4_K_M | 13.1 GB | 15.9 GB |
| Qwen-Image-Edit (2511) | Tight | Q3_K_M | 9.9 GB | 12.9 GB |
| Qwen-Image 2.1 | Runs well | Q8_0 | 7.6 GB | 9.9 GB |
| Z-Image Turbo | Runs well | 16-bit | 12.3 GB | 14.3 GB |
| Z-Image (base) | Runs well | 16-bit | 12.3 GB | 14.3 GB |
| Ideogram 4 | Runs | Q4_1 | 6.2 GB | 14.7 GB |
| Boogu-Image (Turbo) | Runs well | Q8_0 | 11.6 GB | 14.2 GB |
| ERNIE-Image (Turbo) | Runs well | Q8_0 | 8.7 GB | 11.0 GB |
| HiDream-O1-Image | Runs well | FP8 | 8.1 GB | 10.9 GB |
| Mage-Flow (Microsoft) | Runs well | 16-bit | 8.2 GB | 10.0 GB |
| Lumina Image 2.0 | Runs well | 16-bit | 5.2 GB | 7.0 GB |
| HiDream-I1 (Full) | Runs | Q5_K_M | 13.0 GB | 15.8 GB |
| HiDream-I1 (Dev) | Runs | Q5_K_M | 13.0 GB | 15.8 GB |
| Stable Diffusion 3.5 Large | Runs well | Q8_0 | 8.8 GB | 11.1 GB |
| Stable Diffusion 3.5 Medium | Runs well | 16-bit | 5.1 GB | 6.9 GB |
| Chroma1-HD | Runs well | Q8_0 | 9.7 GB | 12.0 GB |
| SDXL 1.0 | Runs well | 16-bit | 6.9 GB | 7.1 GB |
| Illustrious XL / Pony (SDXL anime) | Runs well | 16-bit | 6.9 GB | 7.1 GB |
| Stable Diffusion 1.5 | Runs well | 16-bit | 2.1 GB | 3.3 GB |
| HunyuanImage 2.1 | Runs | Q4_K_M | 11.3 GB | 14.6 GB |
| video models | ||||
| Wan 2.1 T2V 14B | Runs | Q5_K_M | 11.3 GB | 15.6 GB |
| Wan 2.1 T2V 1.3B | Runs well | 16-bit | 2.8 GB | 5.6 GB |
| Wan 2.1 I2V 14B 480P | Runs | Q4_K_M | 11.3 GB | 15.6 GB |
| Wan 2.1 I2V 14B 720P | Tight | Q3_K_M | 8.6 GB | 15.4 GB |
| Wan 2.1 VACE 14B | Tight | Q3_K_S | 7.8 GB | 12.6 GB |
| Wan 2.2 T2V A14B | Runs | Q5_K_M | 10.8 GB | 15.1 GB |
| Wan 2.2 I2V A14B | Runs | Q5_K_M | 10.8 GB | 15.1 GB |
| Wan 2.2 TI2V 5B | Runs well | 16-bit | 10.0 GB | 13.8 GB |
| Wan 2.2 Animate 14B | Tight | Q3_K_M | 8.6 GB | 13.9 GB |
| Wan Animate 2 (14B) | Tight | Q3_K_M | 8.6 GB | 13.9 GB |
| Wan 2.2 S2V 14B | Tight | Q2_K | 9.5 GB | 14.3 GB |
| SCAIL-2 (character animation) | Tight | Q3_K_M | 9.1 GB | 14.4 GB |
| HunyuanVideo (13B, original) | Runs | Q6_K | 11.0 GB | 15.3 GB |
| LTX-Video 13B (0.9.8) | Runs | Q6_K | 10.9 GB | 15.2 GB |
| HunyuanVideo 1.5 | Runs well | Q8_0 | 9.0 GB | 13.3 GB |
| LTX-2 (19B) | Tight | Q3_K_M | 10.1 GB | 14.9 GB |
| LTX-2.3 (22B) | Tight | Q3_K_M | 10.8 GB | 15.6 GB |
| LTX-2.5 (22B) | Tight | Q2_K | 8.8 GB | 13.6 GB |
| MiniMax H3 (33B) | Offload only | Q4_K_M | 19.9 GB | 25.7 GB |
| MiniMax H3 Pruned | Tight | Q3_K_M | 8.9 GB | 14.7 GB |
Assumes a GPU without FP8 compute (Q8_0 preferred for 8-bit). On RTX 40/50, FP8 files are used where available. How the numbers work.
02GPUs with 16 GB
RTX 5080 16 GBRTX 5070 Ti 16 GBRTX 5060 Ti 16 GBRTX 4080 Super 16 GBRTX 4080 16 GBRTX 4070 Ti Super 16 GBRTX 4060 Ti 16 GBRX 9070 XT 16 GBRX 9070 16 GBRX 9060 XT 16 GBRX 7900 GRE 16 GBRX 7800 XT 16 GBRX 7600 XT 16 GBArc A770 16 GBRTX 5080 Laptop 16 GBRTX 4090 Laptop 16 GBRTX 3080 Ti Laptop 16 GBRTX 3080 Laptop 16 GBRX 7900M 16 GB