Datasheet for local AI49 models98 GPUsData read 2026-09-25
No adsNo tracking
Check my GPU →

What AI models run on 12 GB of VRAM?

17 of 49 image and video models run at 8-bit quality or better on 12 GB. Here is every one, with the file to download.

01Every model on 12 GB

ModelVerdictBest fileSizeNeeded
image models
FLUX.1 [dev]RunsQ5_K_S8.3 GB10.6 GB
FLUX.1 [schnell]RunsQ5_K_S8.3 GB10.6 GB
FLUX.1 Kontext [dev]RunsQ5_K_M8.4 GB11.0 GB
FLUX.1 Krea [dev]RunsQ5_K_M8.4 GB10.7 GB
FLUX.1 Fill [dev]RunsQ5_K_S8.3 GB10.9 GB
FLUX.2 [dev]Offload onlyQ4_K_M20.1 GB23.4 GB
FLUX.2 [klein] 9BRuns wellFP89.4 GB11.7 GB
FLUX.2 [klein] 4BRuns well16-bit7.8 GB9.6 GB
Krea 2 (Turbo)RunsQ5_K_M8.9 GB11.5 GB
Qwen-ImageTightQ2_K7.1 GB9.9 GB
Qwen-Image-Edit (2511)TightQ2_K7.5 GB10.5 GB
Qwen-Image 2.1Runs wellQ8_07.6 GB9.9 GB
Z-Image TurboRuns wellQ8_07.2 GB9.2 GB
Z-Image (base)Runs wellQ8_07.2 GB9.2 GB
Ideogram 4Offload onlyQ4_16.2 GB14.7 GB
Boogu-Image (Turbo)RunsQ5_18.6 GB11.2 GB
ERNIE-Image (Turbo)Runs wellQ8_08.7 GB11.0 GB
HiDream-O1-ImageRuns wellFP88.1 GB10.9 GB
Mage-Flow (Microsoft)Runs well16-bit8.2 GB10.0 GB
Lumina Image 2.0Runs well16-bit5.2 GB7.0 GB
HiDream-I1 (Full)TightQ3_K_M8.8 GB11.6 GB
HiDream-I1 (Dev)TightQ3_K_M8.8 GB11.6 GB
Stable Diffusion 3.5 LargeRuns wellQ8_08.8 GB11.1 GB
Stable Diffusion 3.5 MediumRuns well16-bit5.1 GB6.9 GB
Chroma1-HDRuns wellFP89.2 GB11.5 GB
SDXL 1.0Runs well16-bit6.9 GB7.1 GB
Illustrious XL / Pony (SDXL anime)Runs well16-bit6.9 GB7.1 GB
Stable Diffusion 1.5Runs well16-bit2.1 GB3.3 GB
HunyuanImage 2.1TightQ2_K7.3 GB10.6 GB
video models
Wan 2.1 T2V 14BTightQ3_K_M7.6 GB11.9 GB
Wan 2.1 T2V 1.3BRuns well16-bit2.8 GB5.6 GB
Wan 2.1 I2V 14B 480POffload onlyQ3_K_M8.6 GB12.9 GB
Wan 2.1 I2V 14B 720POffload onlyQ4_K_M11.3 GB18.1 GB
Wan 2.1 VACE 14BOffload onlyQ3_K_S7.8 GB12.6 GB
Wan 2.2 T2V A14BTightQ3_K_M7.2 GB11.5 GB
Wan 2.2 I2V A14BTightQ3_K_M7.2 GB11.5 GB
Wan 2.2 TI2V 5BRuns wellQ8_05.4 GB9.2 GB
Wan 2.2 Animate 14BTightQ2_K6.5 GB11.8 GB
Wan Animate 2 (14B)TightQ2_K6.5 GB11.8 GB
Wan 2.2 S2V 14BOffload onlyQ4_K_M13.9 GB18.7 GB
SCAIL-2 (character animation)Offload onlyQ2_K7.3 GB12.6 GB
HunyuanVideo (13B, original)TightQ3_K_M6.2 GB10.5 GB
LTX-Video 13B (0.9.8)TightQ3_K_M6.5 GB10.8 GB
HunyuanVideo 1.5RunsQ6_K7.0 GB11.3 GB
LTX-2 (19B)Offload onlyQ2_K8.1 GB12.9 GB
LTX-2.3 (22B)Offload onlyQ2_K8.3 GB13.1 GB
LTX-2.5 (22B)Offload onlyQ2_K8.8 GB13.6 GB
MiniMax H3 (33B)Offload onlyQ4_K_M19.9 GB25.7 GB
MiniMax H3 PrunedOffload onlyQ4_K_M11.6 GB17.4 GB

Assumes a GPU without FP8 compute (Q8_0 preferred for 8-bit). On RTX 40/50, FP8 files are used where available. How the numbers work.