Datasheet for local AI50 models99 GPUsData read 2026-10-01
No adsNo tracking
Check my GPU →

ComfyUI model files: what each one is and where it goes

74 text encoders, VAEs and other shared files that local image and video models need next to the main model — with the folder, the size and the models that use each one.

Most models in ComfyUI need two or three files: the model itself (in models/diffusion_models, or models/unet for GGUF), a text encoder (models/text_encoders) and a VAE (models/vae). Many of these files are shared: one T5-XXL or one Wan VAE serves several models, so you only download it once.

models/text_encoders · 44 text encoder files

FileSizeUsed by
umt5_xxl_fp16.safetensors
UMT5-XXL FP16
11.4 GBWan 2.1 14B, Wan 2.1 1.3B, Wan 2.1 I2V 480P, Wan 2.1 I2V 720P …
umt5_xxl_fp8_e4m3fn_scaled.safetensors
UMT5-XXL FP8 (scaled)
6.7 GBWan 2.1 14B, Wan 2.1 1.3B, Wan 2.1 I2V 480P, Wan 2.1 I2V 720P …
t5xxl_fp16.safetensors
T5-XXL FP16
9.8 GBFLUX.1 dev, FLUX.1 schnell, FLUX.1 Kontext, FLUX.1 Krea …
clip_l.safetensors
CLIP-L
0.2 GBFLUX.1 dev, FLUX.1 schnell, FLUX.1 Kontext, FLUX.1 Krea …
t5xxl_fp8_e4m3fn.safetensors
T5-XXL FP8
4.9 GBFLUX.1 dev, FLUX.1 schnell, FLUX.1 Kontext, FLUX.1 Krea …
qwen_2.5_vl_7b.safetensors
Qwen2.5-VL 7B BF16
16.6 GBQwen-Image, Qwen-Image-Edit, HunyuanImage 2.1, HunyuanVideo 1.5
qwen_2.5_vl_7b_fp8_scaled.safetensors
Qwen2.5-VL 7B FP8
9.4 GBQwen-Image, Qwen-Image-Edit, HunyuanImage 2.1, HunyuanVideo 1.5
qwen_3_4b.safetensors
Qwen3 4B BF16
8.0 GBFLUX.2 klein 4B, Z-Image Turbo, Z-Image
qwen_3_4b_fp8_mixed.safetensors
Qwen3 4B FP8
5.6 GBFLUX.2 klein 4B, Z-Image Turbo, Z-Image
t5xxl_fp8_e4m3fn_scaled.safetensors
T5-XXL FP8 scaled
5.2 GBHiDream-I1, HiDream-I1 Full, LTX-Video 13B
byt5_small_glyphxl_fp16.safetensors
ByT5 small Glyph-XL
0.4 GBHunyuanImage 2.1, HunyuanVideo 1.5
clip_g.safetensors
CLIP-G
1.4 GBSD 3.5 Large, SD 3.5 Medium
clip_g_hidream.safetensors
CLIP-G (HiDream)
1.4 GBHiDream-I1, HiDream-I1 Full
clip_l_hidream.safetensors
CLIP-L (HiDream)
0.2 GBHiDream-I1, HiDream-I1 Full
gemma_3_12B_it.safetensors
Gemma 3 12B BF16
24.4 GBLTX-2, LTX-2.3
gemma_3_12B_it_fp4_mixed.safetensors
Gemma 3 12B FP4 mixed
9.4 GBLTX-2, LTX-2.3
gemma_3_12B_it_fp8_scaled.safetensors
Gemma 3 12B FP8 (scaled)
13.2 GBLTX-2, LTX-2.3
llama_3.1_8b_instruct_fp8_scaled.safetensors
Llama 3.1 8B Instruct FP8
9.1 GBHiDream-I1, HiDream-I1 Full
qwen3vl_32b_minimax_h3_bf16.safetensors
Qwen3-VL 32B BF16
51.5 GBMiniMax H3, MiniMax H3 Pruned
qwen3vl_32b_minimax_h3_int8_convrot.safetensors
Qwen3-VL 32B INT8 (convrot)
27.1 GBMiniMax H3, MiniMax H3 Pruned
qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
Qwen3-VL 32B NVFP4 (AWQ)
15.7 GBMiniMax H3, MiniMax H3 Pruned
qwen3vl_4b_bf16.safetensors
Qwen3-VL 4B BF16
8.9 GBKrea 2, Mage-Flow
qwen3vl_8b_fp8_scaled.safetensors
Qwen3-VL 8B FP8
10.6 GBIdeogram 4, Boogu-Image
ernie-image-prompt-enhancer.safetensors
ERNIE prompt enhancer (optional)
6.9 GBERNIE-Image
gemma4-12b-with-proj-ltx-2.5-bf16.safetensors
Gemma 4 12B + LTX projection BF16
26.3 GBLTX-2.5
gemma4-12b-with-proj-ltx-2.5-comfy-int8-convrot.safetensors
Gemma 4 12B + LTX projection INT8 (convrot)
15.4 GBLTX-2.5
gemma4_e2b_it_int8_convrot.safetensors
Gemma 4 E2B INT8 (prompt enhancer, optional)
5.2 GBLTX-2.5
gemma_2_2b_fp16.safetensors
Gemma 2 2B FP16
5.2 GBLumina 2.0
llava_llama3_fp16.safetensors
LLaVA-Llama3 FP16
16.1 GBHunyuanVideo 13B
llava_llama3_fp8_scaled.safetensors
LLaVA-Llama3 FP8 (scaled)
9.1 GBHunyuanVideo 13B
ltx-2-19b-dev_embeddings_connectors.safetensors
LTX-2 text embeddings connectors (projection)
2.9 GBLTX-2
ltx-2.3-22b-dev_embeddings_connectors.safetensors
LTX-2.3 text embeddings connectors (projection)
2.3 GBLTX-2.3
ming_image_0.1_ling_mini_2.0_bf16.safetensors
Ling-Mini-2.0 BF16
36.7 GBMing-Image
ming_image_0.1_ling_mini_2.0_int8_convrot.safetensors
Ling-Mini-2.0 INT8
19.5 GBMing-Image
ming_image_0.1_ling_mini_2.0_w4a8.safetensors
Ling-Mini-2.0 (4-bit w4a8)
12.8 GBMing-Image
ministral-3-3b.safetensors
Ministral 3 3B
7.7 GBERNIE-Image
mistral_3_small_flux2_bf16.safetensors
Mistral 3 Small BF16
35.6 GBFLUX.2 dev
mistral_3_small_flux2_fp8.safetensors
Mistral 3 Small FP8
18.0 GBFLUX.2 dev
qwen3vl_4b_fp8_scaled.safetensors
Qwen3-VL 4B FP8
5.2 GBKrea 2
qwen3vl_8b_bf16.safetensors
Qwen3-VL 8B BF16
17.5 GBQwen-Image 2.1
qwen3vl_8b_int8_convrot.safetensors
Qwen3-VL 8B INT8
9.4 GBQwen-Image 2.1
qwen3vl_8b_nvfp4.safetensors
Qwen3-VL 8B NVFP4
6.3 GBIdeogram 4
qwen_3_8b.safetensors
Qwen3 8B BF16
16.4 GBFLUX.2 klein 9B
qwen_3_8b_fp8mixed.safetensors
Qwen3 8B FP8
8.7 GBFLUX.2 klein 9B

models/vae · 22 VAE files

FileSizeUsed by
ae.safetensors
FLUX.1 VAE (ae)
0.3 GBFLUX.1 dev, FLUX.1 schnell, FLUX.1 Kontext, FLUX.1 Krea …
wan_2.1_vae.safetensors
Wan 2.1 VAE
0.3 GBWan 2.1 14B, Wan 2.1 1.3B, Wan 2.1 I2V 480P, Wan 2.1 I2V 720P …
flux2-vae.safetensors
FLUX.2 VAE
0.3 GBFLUX.2 dev, FLUX.2 klein 9B, FLUX.2 klein 4B, Ideogram 4 …
qwen_image_vae.safetensors
Qwen-Image VAE
0.3 GBKrea 2, Qwen-Image, Qwen-Image-Edit
minimax_h3_audio_vae_fp32.safetensors
MiniMax H3 audio VAE FP32
0.6 GBMiniMax H3, MiniMax H3 Pruned
minimax_h3_video_vae_fp16.safetensors
MiniMax H3 video VAE FP16
5.2 GBMiniMax H3, MiniMax H3 Pruned
Wan2_1_VAE_bf16.safetensors
Wan 2.1 VAE BF16 (Kijai)
0.3 GBWan Animate 2, SCAIL-2
flux1_vae_bf16.safetensors
FLUX.1 VAE BF16
0.2 GBBoogu-Image
hunyuan_image_2.1_vae_fp16.safetensors
HunyuanImage 2.1 VAE
0.8 GBHunyuanImage 2.1
hunyuan_video_vae_bf16.safetensors
HunyuanVideo VAE BF16
0.5 GBHunyuanVideo 13B
hunyuanvideo15_vae_fp16.safetensors
HunyuanVideo 1.5 VAE FP16
2.5 GBHunyuanVideo 1.5
ltx-2-19b-dev_audio_vae.safetensors
LTX-2 audio VAE
0.2 GBLTX-2
ltx-2-19b-dev_video_vae.safetensors
LTX-2 video VAE
2.4 GBLTX-2
ltx-2.3-22b-dev_audio_vae.safetensors
LTX-2.3 audio VAE
0.4 GBLTX-2.3
ltx-2.3-22b-dev_video_vae.safetensors
LTX-2.3 video VAE
1.5 GBLTX-2.3
ltx-2.5-audio-vae-bf16.safetensors
LTX-2.5 audio VAE + vocoder BF16
0.4 GBLTX-2.5
ltx-2.5-video-vae-bf16.safetensors
LTX-2.5 video VAE (DiffVAE) BF16
1.5 GBLTX-2.5
LTXV-13B-0.9.8-dev-VAE.safetensors
LTXV 13B 0.9.8 VAE (standalone, QuantStack)
2.5 GBLTX-Video 13B
mage_flow_vae_bf16.safetensors
Mage-Flow VAE
0.3 GBMage-Flow
ming_image_vae_bf16.safetensors
Ming-Image VAE
0.3 GBMing-Image
qwen_image_2.1_vae_bf16.safetensors
Qwen-Image 2.1 VAE
0.7 GBQwen-Image 2.1
wan2.2_vae.safetensors
Wan 2.2 VAE
1.4 GBWan 2.2 5B

models/clip_vision · 3 vision encoder files

FileSizeUsed by
clip_vision_h.safetensors
CLIP Vision H
1.3 GBWan 2.1 I2V 480P, Wan 2.1 I2V 720P, Wan 2.2 Animate, Wan Animate 2 …
llava_llama3_vision.safetensors
LLaVA-Llama3 vision
0.6 GBHunyuanVideo 13B
sigclip_vision_patch14_384.safetensors
SigCLIP vision patch14 384
0.9 GBHunyuanVideo 1.5

models/audio_encoders · 1 audio encoder file

FileSizeUsed by
wav2vec2_large_english_fp16.safetensors
wav2vec2 large English FP16 (audio encoder)
0.6 GBWan 2.2 S2V

models/latent_upscale_models · 3 latent upscaler files

FileSizeUsed by
ltx-2-spatial-upscaler-x2-1.0.safetensors
LTX-2 spatial upscaler x2
1.0 GBLTX-2
ltx-2.3-spatial-upscaler-x2-1.1.safetensors
LTX-2.3 spatial upscaler x2 1.1
1.0 GBLTX-2.3
ltx-2.5-latent-spatial-upscaler-x2-bf16-1.0.safetensors
LTX-2.5 latent spatial upscaler x2
1.0 GBLTX-2.5

models/checkpoints · 1 checkpoint file

FileSizeUsed by
sam3.1_multiplex_fp16.safetensors
SAM 3.1 multiplex FP16 (segmentation)
1.7 GBSCAIL-2

The main model files are listed on each model page, with the right size for your card.