Skip to content

Best AI Models for 16 GB VRAM

The sweet spot — 14B at Q8, smaller models at full precision. Here are all 59 models you can run locally with 16 GB of memory.

Hardware with 16 GB Memory

Runs Comfortably (55)

These models fit with room to spare for context window and OS overhead.

ModelParamsQuantizationVRAMQuality
Qwen 3.5 35B A3B35BQ4_K_M12 GB4
InternLM 2.5 20B20BQ4_K_M12 GB4
StarCoder2 15B15BQ5_K_M12 GB4
DeepSeek R1 14B14BQ5_K_M11.3 GB4
Phi-4 14B14BQ5_K_M11.3 GB4
Phi-4 Reasoning 14B14BQ4_K_M11 GB4
Qwen 2.5 14B14BQ5_K_M11.3 GB4
Qwen 2.5 Coder 14B14BQ4_K_M12 GB4
Qwen 3 14B14BQ4_K_M12 GB4
Gemma 3 12B12BQ4_K_M10.5 GB4
Mistral Nemo 12B12BQ4_K_M9.5 GB4
Falcon 3 10B10BQ8_013 GB4
Gemma 2 9B9BQ8_011 GB4
Qwen 3.5 9B9BQ8_011.5 GB5
Yi 1.5 9B9BQ8_011 GB5
Yi Coder 9B9BQ8_012 GB5
Aya Expanse 8B8BQ8_010.5 GB5
Cogito 8B8BQ8_011 GB4
DeepSeek R1 8B8BQ8_011.5 GB4
Dolphin 3 8B8BQ8_010 GB5
Granite 3.3 8B8BQ8_010 GB4
Llama 3.1 8B8BQ8_010 GB4
Nemotron 3 Nano 8B8BQ8_011 GB4
Nous Hermes 2 8B8BQ8_010 GB5
Qwen 3 8B8BQ8_011.5 GB4
Codestral Mamba 7B7BQ8_09.9 GB5
DeepSeek R1 7B7BQ8_09 GB4
Falcon 3 7B7BQ8_010 GB4
InternLM 2.5 7B7BQ8_09 GB5
Mistral 7B7BQ8_09 GB4
OpenChat 3.5 7B7BQ8_09.9 GB5
Qwen 2.5 7B7BQ8_09 GB4
Qwen 2.5 Coder 7B7BQ8_09 GB4
Qwen 2.5 VL 7B7BQ8_010.5 GB4
StarCoder2 7B7BQ8_09 GB5
WizardLM 2 7B7BQ8_09.9 GB5
Gemma 3 4B4BF1611.5 GB5
Gemma 3n E4B4BF1611 GB5
Gemma 4 E4B4BQ8_010 GB5
Qwen 3 4B4BF1611 GB5
Qwen 3.5 4B4BQ8_06.5 GB4
Phi-3 Mini 3.8B3.8BF169.6 GB5
Phi-4 Mini 3.8B3.8BF1610.5 GB5
Llama 3.2 3B3BF168 GB5
StarCoder2 3B3BF168 GB5
Gemma 2 2B2BF166 GB5
Gemma 3n E2B2BF166.5 GB5
Gemma 4 E2B2BQ8_06 GB5
Qwen 3.5 2B2BQ8_04.5 GB4
SmolLM2 1.7B1.7BF164.4 GB5
DeepSeek R1 1.5B1.5BF165 GB5
Gemma 3 1B1BF163.5 GB5
Llama 3.2 1B1BF164 GB5
Qwen 3.5 0.8B0.8BQ8_02 GB4
Qwen 3 0.6B0.6BF163.3 GB5

Tight Fit (4)

These models run but with limited context window. Close other apps to free memory.

ModelParamsQuantizationVRAMQuality
Codestral 22B22BQ4_K_M14.7 GB4
gpt-oss 20B21BMXFP415 GB4
Llama 3.2 Vision 11B11BQ8_014 GB4
Yi 1.5 6B6BF1614 GB5

Want to check a specific combination?

Use the compatibility checker to see exactly how a model runs on your specific hardware, with performance estimates.

Open Compatibility Checker
8 GBEntry-level local AI 12 GBThe minimum for a good experience 24 GBSerious local AI 32 GBPremium tier