Datasheet for local AI49 models98 GPUsData read 2026-09-25
No adsNo tracking
Check my GPU →

RTX 3050 Ti Laptop 4 GB for local AI

Which image and video models run on the RTX 3050 Ti Laptop 4 GB, which file to download for each, and how much VRAM they need.

NVIDIA4 GB GDDR6 · 128-bit · Ampere · 35–80 WData 2026-09-25
VRAM4 GB
MemoryGDDR6
Bus128-bit
Bandwidth—
ArchitectureAmpere
Launched2021-05
Power35–80 W
Runs well1 of 49

Specs: www.notebookcheck.net · launch: www.notebookcheck.net

01What runs on it

ModelVerdictBest fileSizeNeeded
image models
FLUX.1 [dev]Offload onlyQ4_K_S6.8 GB9.1 GB
FLUX.1 [schnell]Offload onlyQ4_K_S6.8 GB9.1 GB
FLUX.1 Kontext [dev]Offload onlyQ4_K_M6.9 GB9.5 GB
FLUX.1 Krea [dev]Offload onlyQ4_K_M6.9 GB9.2 GB
FLUX.1 Fill [dev]Offload onlyQ4_K_S6.8 GB9.4 GB
FLUX.2 [dev]Not practicalQ2_K12.9 GB16.2 GB
FLUX.2 [klein] 9BOffload onlyQ4_K_M5.9 GB8.2 GB
FLUX.2 [klein] 4BTightQ3_K_M2.1 GB3.9 GB
Krea 2 (Turbo)Offload onlyQ4_K_M7.5 GB10.1 GB
Qwen-ImageNot practicalQ2_K7.1 GB9.9 GB
Qwen-Image-Edit (2511)Not practicalQ2_K7.5 GB10.5 GB
Qwen-Image 2.1Offload onlyQ3_K_M3.2 GB5.5 GB
Z-Image TurboOffload onlyQ2_K3.6 GB5.6 GB
Z-Image (base)Offload onlyQ4_K_M5.1 GB7.1 GB
Ideogram 4Not practicalQ4_16.2 GB14.7 GB
Boogu-Image (Turbo)Offload onlyQ4_17.4 GB10.0 GB
ERNIE-Image (Turbo)Offload onlyQ2_K3.2 GB5.5 GB
HiDream-O1-ImageNot practicalFP88.1 GB10.9 GB
Mage-Flow (Microsoft)Offload onlyINT84.2 GB6.0 GB
Lumina Image 2.0RunsQ6_K2.1 GB3.9 GB
HiDream-I1 (Full)Not practicalQ2_K6.6 GB9.4 GB
HiDream-I1 (Dev)Not practicalQ2_K6.6 GB9.4 GB
Stable Diffusion 3.5 LargeOffload onlyQ4_15.3 GB7.6 GB
Stable Diffusion 3.5 MediumRunsQ5_K_M2.1 GB3.9 GB
Chroma1-HDOffload onlyQ2_K3.4 GB5.7 GB
SDXL 1.0Offload only16-bit6.9 GB7.1 GB
Illustrious XL / Pony (SDXL anime)RunsQ5_K_M1.8 GB3.8 GB
Stable Diffusion 1.5Runs well16-bit2.1 GB3.3 GB
HunyuanImage 2.1Not practicalQ2_K7.3 GB10.6 GB
video models
Wan 2.1 T2V 14BNot practicalQ3_K_M7.6 GB11.9 GB
Wan 2.1 T2V 1.3BRunsQ6_K1.2 GB4.0 GB
Wan 2.1 I2V 14B 480PNot practicalQ3_K_M8.6 GB12.9 GB
Wan 2.1 I2V 14B 720PNot practicalQ3_K_M8.6 GB15.4 GB
Wan 2.1 VACE 14BNot practicalQ3_K_S7.8 GB12.6 GB
Wan 2.2 T2V A14BNot practicalQ2_K5.3 GB9.6 GB
Wan 2.2 I2V A14BNot practicalQ2_K5.3 GB9.6 GB
Wan 2.2 TI2V 5BOffload onlyQ2_K1.9 GB5.7 GB
Wan 2.2 Animate 14BNot practicalQ2_K6.5 GB11.8 GB
Wan Animate 2 (14B)Not practicalQ2_K6.5 GB11.8 GB
Wan 2.2 S2V 14BNot practicalQ2_K9.5 GB14.3 GB
SCAIL-2 (character animation)Not practicalQ2_K7.3 GB12.6 GB
HunyuanVideo (13B, original)Offload onlyQ4_K_M7.9 GB12.2 GB
LTX-Video 13B (0.9.8)Not practicalQ2_K4.7 GB9.0 GB
HunyuanVideo 1.5Offload onlyQ4_K_M5.1 GB9.4 GB
LTX-2 (19B)Not practicalQ2_K8.1 GB12.9 GB
LTX-2.3 (22B)Not practicalQ2_K8.3 GB13.1 GB
LTX-2.5 (22B)Not practicalQ2_K8.8 GB13.6 GB
MiniMax H3 (33B)Not practicalQ3_K_M15.6 GB21.4 GB
MiniMax H3 PrunedNot practicalQ3_K_M8.9 GB14.7 GB

Calculated from real file sizes plus working memory. How the numbers work.

02Good to know

The RTX 3050 Ti Laptop 4 GB (Ampere) has no FP8 compute. FP8 files still load and save memory, but ComfyUI converts them back before the maths, so there is no speed gain — Q8_0 GGUF is the closer-to-original 8-bit choice. ComfyUI can compute INT8 files natively on NVIDIA, which is worth a try where a model offers one. As a laptop GPU it runs at a lower power limit than desktop cards (35–80 W depending on the laptop). The memory verdicts are the same; speed depends heavily on how much power the laptop maker allows.

03Measured and reported results

No measured results yet. Send yours.