The model index
All 114 open-weight models we track, grouped by size — because the first question is always whether it fits. Smallest VRAM footprint first within each tier.
Tinyunder 3B
10Runs on almost anything — phones, a Raspberry Pi, any laptop.
Gemma 3 1B
1Bmin 1.5 GBtext generationmultilingualsummarizationQwen 3.5 0.8B
800Mmin 1.5 GBtext generationreasoningmultilingualSmolLM2 1.7B
1.7Bmin 1.9 GBtext generationcode generationsummarizationDeepSeek R1 1.5B
1.5Bmin 2 GBtext generationreasoningmathLlama 3.2 1B
1Bmin 2.1 GBtext generationsummarizationQwen 3 0.6B
600Mmin 2.5 GBtext generationreasoningmultilingualGemma 2 2B
2Bmin 2.7 GBtext generationcode generationmultilingualQwen 3.5 2B
2Bmin 3 GBtext generationcode generationreasoningGemma 3n E2B
2Bmin 3.3 GBtext generationreasoningmultilingualGemma 4 E2B
2Bmin 4 GBtext generationreasoningmultilingualSmall3–9B
30Comfortable on 8 GB GPUs and entry-level Macs.
Llama 3.2 3B
3Bmin 3.3 GBtext generationcode generationmultilingualStarCoder2 3B
3Bmin 3.5 GBcode generationtext generationPhi-3 Mini 3.8B
3.8Bmin 3.8 GBtext generationcode generationreasoningGemma 3n E4B
4Bmin 4.5 GBtext generationreasoningmultilingualPhi-4 Mini 3.8B
3.8Bmin 4.5 GBtext generationcode generationreasoningQwen 3 4B
4Bmin 4.5 GBtext generationcode generationreasoningQwen 3.5 4B
4Bmin 4.5 GBtext generationcode generationreasoningGemma 3 4B
4Bmin 5 GBtext generationcode generationreasoningYi 1.5 6B
6Bmin 5 GBtext generationcode generationreasoningInternLM 2.5 7B
7Bmin 5.5 GBtext generationcode generationreasoningStarCoder2 7B
7Bmin 5.5 GBcode generationtext generationDeepSeek R1 7B
7Bmin 5.7 GBtext generationcode generationreasoningMistral 7B
7Bmin 5.7 GBtext generationcode generationmultilingualQwen 2.5 7B
7Bmin 5.7 GBtext generationcode generationmultilingualQwen 2.5 Coder 7B
7Bmin 5.7 GBtext generationcode generationDolphin 3 8B
8Bmin 6 GBtext generationcode generationreasoningGemma 4 E4B
4Bmin 6 GBtext generationcode generationreasoningGranite 3.3 8B
8Bmin 6 GBtext generationcode generationreasoningNous Hermes 2 8B
8Bmin 6 GBtext generationcode generationreasoningLlama 3.1 8B
8Bmin 6.3 GBtext generationcode generationmultilingualAya Expanse 8B
8Bmin 6.5 GBtext generationmultilingualcreative writingFalcon 3 7B
7Bmin 6.8 GBtext generationcode generationreasoningCodestral Mamba 7B
7Bmin 6.9 GBcode generationtext generationOpenChat 3.5 7B
7Bmin 6.9 GBtext generationcode generationreasoningWizardLM 2 7B
7Bmin 6.9 GBtext generationcode generationreasoningQwen 2.5 VL 7B
7Bmin 7 GBtext generationvisionreasoningCogito 8B
8Bmin 7.5 GBtext generationcode generationreasoningDeepSeek R1 8B
8Bmin 7.5 GBtext generationcode generationreasoningNemotron 3 Nano 8B
8Bmin 7.5 GBtext generationcode generationreasoningQwen 3 8B
8Bmin 7.5 GBtext generationcode generationreasoningMedium9–32B
28Wants a 16–24 GB card or a 32 GB+ Mac.
Yi 1.5 9B
9Bmin 6.5 GBtext generationcode generationreasoningGemma 2 9B
9Bmin 6.9 GBtext generationcode generationreasoningQwen 3.5 9B
9Bmin 7.5 GBtext generationcode generationreasoningYi Coder 9B
9Bmin 8 GBcode generationtext generationreasoningFalcon 3 10B
10Bmin 8.5 GBtext generationcode generationreasoningLlama 3.2 Vision 11B
11Bmin 8.5 GBtext generationvisionreasoningMistral Nemo 12B
12Bmin 9.5 GBtext generationcode generationreasoningDeepSeek R1 14B
14Bmin 9.9 GBtext generationcode generationreasoningPhi-4 14B
14Bmin 9.9 GBtext generationcode generationreasoningQwen 2.5 14B
14Bmin 9.9 GBtext generationcode generationreasoningGemma 3 12B
12Bmin 10.5 GBtext generationcode generationreasoningStarCoder2 15B
15Bmin 10.5 GBtext generationcode generationPhi-4 Reasoning 14B
14Bmin 11 GBtext generationcode generationreasoningInternLM 2.5 20B
20Bmin 12 GBtext generationcode generationreasoningQwen 2.5 Coder 14B
14Bmin 12 GBtext generationcode generationQwen 3 14B
14Bmin 12 GBtext generationcode generationreasoningCodestral 22B
22Bmin 14.7 GBtext generationcode generationgpt-oss 20B
21Bmin 15 GBtext generationcode generationreasoningDevstral 24B
24Bmin 17 GBtext generationcode generationreasoningMagistral Small 24B
24Bmin 17 GBtext generationcode generationreasoningGemma 2 27B
27Bmin 17.7 GBtext generationcode generationreasoningMistral Small 3.1 24B
24Bmin 18 GBtext generationcode generationreasoningQwen 3.5 27B
27Bmin 19 GBtext generationcode generationreasoningGemma 3 27B
27Bmin 20 GBtext generationcode generationreasoningGemma 4 26B
26Bmin 20 GBtext generationcode generationreasoningQwen 3.6 27B
27Bmin 20 GBtext generationcode generationreasoningGemma 4 31B
31Bmin 22 GBtext generationcode generationreasoningQwen 3 30B-A3B (MoE)
30Bmin 22 GBtext generationcode generationreasoningLarge32–70B
16High-end GPUs (24–48 GB) or 64 GB+ unified memory.
Qwen 3.5 35B A3B
35Bmin 12 GBtext generationcode generationreasoningNous Hermes 2 34B
34Bmin 19 GBtext generationcode generationreasoningDeepSeek R1 32B
32Bmin 20.7 GBtext generationcode generationreasoningQwen 2.5 32B
32Bmin 20.7 GBtext generationcode generationreasoningYi 1.5 34B
34Bmin 21 GBtext generationcode generationreasoningCogito 32B
32Bmin 21.5 GBtext generationcode generationreasoningQwQ 32B
32Bmin 21.5 GBtext generationcode generationreasoningAya Expanse 32B
32Bmin 22 GBtext generationmultilingualcreative writingLaguna XS 2.1
33Bmin 22 GBtext generationcode generationreasoningWizardCoder 33B
33Bmin 22 GBcode generationtext generationreasoningCommand R 35B
35Bmin 22.5 GBtext generationreasoningmultilingualQwen 2.5 Coder 32B
32Bmin 23 GBtext generationcode generationreasoningQwen 3 32B
32Bmin 23 GBtext generationcode generationreasoningDolphin Mixtral 8x7B
47Bmin 26 GBtext generationcode generationreasoningQwen 3.6 35B-A3B
35Bmin 27 GBtext generationcode generationreasoningMixtral 8x7B
47Bmin 29.7 GBtext generationcode generationreasoningHuge70B and up
30Workstation territory — multi-GPU or 96 GB+ Macs. MoE models cheat the rules.
Qwen 2.5 VL 72B
72Bmin 41 GBtext generationvisionreasoningCogito 70B
70Bmin 43 GBtext generationcode generationreasoningDeepSeek R1 70B
70Bmin 43.5 GBtext generationcode generationreasoningLlama 3.1 70B
70Bmin 43.5 GBtext generationcode generationreasoningLlama 3.3 70B
70Bmin 43.5 GBtext generationcode generationreasoningQwen 2.5 72B
72Bmin 44.7 GBtext generationcode generationreasoningLlama 3.2 Vision 90B
90Bmin 50 GBtext generationvisionreasoningCommand R+ 104B
104Bmin 57 GBtext generationcode generationreasoningCommand A 111B
111Bmin 61 GBtext generationcode generationreasoningDevstral 2 123B
123Bmin 67 GBtext generationcode generationreasoningMistral Large 2 123B
123Bmin 67 GBtext generationcode generationreasoninggpt-oss 120B
117Bmin 70 GBtext generationcode generationreasoningLlama 4 Scout (109B/17B active)
109Bmin 72 GBtext generationcode generationreasoningQwen 3.5 122B
122Bmin 85 GBtext generationcode generationreasoningMixtral 8x22B
141Bmin 86 GBtext generationcode generationreasoningQwen 3 235B-A22B
235Bmin 138 GBtext generationcode generationreasoningNemotron Ultra 253B
253Bmin 155 GBtext generationcode generationreasoningMiniMax M3
428Bmin 163 GBtext generationcode generationreasoningLlama 4 Maverick
400Bmin 228 GBtext generationcode generationreasoningLlama 3.1 405B
405Bmin 244.5 GBtext generationcode generationreasoningGLM-5.2
753Bmin 274 GBtext generationcode generationreasoningGLM-5
744Bmin 300 GBtext generationcode generationreasoningGLM-5.1
754Bmin 305 GBtext generationcode generationreasoningKimi K2.7 Code
1Tmin 359 GBtext generationcode generationreasoningKimi K2.6
1Tmin 360 GBtext generationcode generationreasoningDeepSeek R1 671B
671Bmin 362 GBtext generationcode generationreasoningDeepSeek V3
671Bmin 362 GBtext generationcode generationreasoningDeepSeek V3-0324
671Bmin 362 GBtext generationcode generationreasoningKimi K2.5
1Tmin 390 GBtext generationcode generationreasoningDeepSeek V3.2
671Bmin 420 GBtext generationcode generationreasoning