What AI models run on 20 GB of VRAM?
32 of 49 image and video models run at 8-bit quality or better on 20 GB. Here is every one, with the file to download.
01Every model on 20 GB
| Model | Verdict | Best file | Size | Needed |
|---|---|---|---|---|
| image models | ||||
| FLUX.1 [dev] | Runs well | Q8_0 | 12.7 GB | 15.0 GB |
| FLUX.1 [schnell] | Runs well | Q8_0 | 12.7 GB | 15.0 GB |
| FLUX.1 Kontext [dev] | Runs well | Q8_0 | 12.7 GB | 15.3 GB |
| FLUX.1 Krea [dev] | Runs well | Q8_0 | 12.7 GB | 15.0 GB |
| FLUX.1 Fill [dev] | Runs well | Q8_0 | 12.7 GB | 15.3 GB |
| FLUX.2 [dev] | Tight | Q3_K_M | 16.0 GB | 19.3 GB |
| FLUX.2 [klein] 9B | Runs well | Q8_0 | 10.0 GB | 12.3 GB |
| FLUX.2 [klein] 4B | Runs well | 16-bit | 7.8 GB | 9.6 GB |
| Krea 2 (Turbo) | Runs well | Q8_0 | 13.7 GB | 16.3 GB |
| Qwen-Image | Runs | Q6_K | 16.8 GB | 19.6 GB |
| Qwen-Image-Edit (2511) | Runs | Q6_K | 16.9 GB | 19.9 GB |
| Qwen-Image 2.1 | Runs well | 16-bit | 14.2 GB | 16.5 GB |
| Z-Image Turbo | Runs well | 16-bit | 12.3 GB | 14.3 GB |
| Z-Image (base) | Runs well | 16-bit | 12.3 GB | 14.3 GB |
| Ideogram 4 | Runs | Q5_1 | 7.3 GB | 17.0 GB |
| Boogu-Image (Turbo) | Runs well | Q8_0 | 11.6 GB | 14.2 GB |
| ERNIE-Image (Turbo) | Runs well | 16-bit | 16.1 GB | 18.4 GB |
| HiDream-O1-Image | Runs well | 16-bit | 16.4 GB | 19.2 GB |
| Mage-Flow (Microsoft) | Runs well | 16-bit | 8.2 GB | 10.0 GB |
| Lumina Image 2.0 | Runs well | 16-bit | 5.2 GB | 7.0 GB |
| HiDream-I1 (Full) | Runs well | FP8 | 17.1 GB | 19.9 GB |
| HiDream-I1 (Dev) | Runs well | FP8 | 17.1 GB | 19.9 GB |
| Stable Diffusion 3.5 Large | Runs well | 16-bit | 16.5 GB | 18.8 GB |
| Stable Diffusion 3.5 Medium | Runs well | 16-bit | 5.1 GB | 6.9 GB |
| Chroma1-HD | Runs well | Q8_0 | 9.7 GB | 12.0 GB |
| SDXL 1.0 | Runs well | 16-bit | 6.9 GB | 7.1 GB |
| Illustrious XL / Pony (SDXL anime) | Runs well | 16-bit | 6.9 GB | 7.1 GB |
| Stable Diffusion 1.5 | Runs well | 16-bit | 2.1 GB | 3.3 GB |
| HunyuanImage 2.1 | Runs | Q6_K | 15.7 GB | 19.0 GB |
| video models | ||||
| Wan 2.1 T2V 14B | Runs well | FP8 | 14.3 GB | 18.6 GB |
| Wan 2.1 T2V 1.3B | Runs well | 16-bit | 2.8 GB | 5.6 GB |
| Wan 2.1 I2V 14B 480P | Runs | Q6_K | 14.2 GB | 18.5 GB |
| Wan 2.1 I2V 14B 720P | Runs | Q5_K_M | 12.7 GB | 19.5 GB |
| Wan 2.1 VACE 14B | Runs | Q6_K | 14.5 GB | 19.3 GB |
| Wan 2.2 T2V A14B | Runs well | Q8_0 | 15.4 GB | 19.7 GB |
| Wan 2.2 I2V A14B | Runs well | Q8_0 | 15.4 GB | 19.7 GB |
| Wan 2.2 TI2V 5B | Runs well | 16-bit | 10.0 GB | 13.8 GB |
| Wan 2.2 Animate 14B | Runs | Q6_K | 14.6 GB | 19.9 GB |
| Wan Animate 2 (14B) | Runs | Q6_K | 14.2 GB | 19.5 GB |
| Wan 2.2 S2V 14B | Runs | Q5_K_M | 15.0 GB | 19.8 GB |
| SCAIL-2 (character animation) | Runs | Q6_K | 14.2 GB | 19.5 GB |
| HunyuanVideo (13B, original) | Runs well | Q8_0 | 14.0 GB | 18.3 GB |
| LTX-Video 13B (0.9.8) | Runs well | Q8_0 | 14.0 GB | 18.3 GB |
| HunyuanVideo 1.5 | Runs well | Q8_0 | 9.0 GB | 13.3 GB |
| LTX-2 (19B) | Runs | Q5_K_M | 14.3 GB | 19.1 GB |
| LTX-2.3 (22B) | Runs | Q4_K_M | 14.3 GB | 19.1 GB |
| LTX-2.5 (22B) | Runs | Q4_K_M | 15.1 GB | 19.9 GB |
| MiniMax H3 (33B) | Offload only | Q3_K_M | 15.6 GB | 21.4 GB |
| MiniMax H3 Pruned | Runs | Q5_K_M | 14.1 GB | 19.9 GB |
Assumes a GPU without FP8 compute (Q8_0 preferred for 8-bit). On RTX 40/50, FP8 files are used where available. How the numbers work.