β All modelsBROWSE BY RAM
Best local LLMs for 32 GB RAM
With 32 GB of total memory, 62 of the 73 models in our catalog run comfortably at the recommended 4-bit quantization. Top pick: Qwen 3.5 35B-A3B (21.2 GB download).
Reading your hardware signalsβ¦
All models that run on 32 GB
62 / 73 models| Model | Params | Download (Q4) | Min RAM | Best for |
|---|---|---|---|---|
| Qwen 3.5 35B-A3B | 35B (A3B) | 21.2 GB | 32 GB | Chat, Reasoning, Coding, Vision |
| Qwen 3.6 35B-A3B | 35B (A3B) | 21.2 GB | 32 GB | Chat, Reasoning, Coding, Vision |
| Command R 35B | 35B | 21.2 GB | 32 GB | Chat |
| Qwen3-VL 32B | 33B | 20.0 GB | 32 GB | Vision, Chat, Reasoning |
| EXAONE 4.5 33B | 33B | 20.0 GB | 32 GB | Vision, Reasoning, Chat |
| Qwen 3 32B | 32.8B | 19.9 GB | 32 GB | Chat, Reasoning |
| Qwen 2.5 Coder 32B | 32.8B | 19.9 GB | 32 GB | Coding |
| QwQ 32B | 32.8B | 19.9 GB | 32 GB | Reasoning |
| DeepSeek R1 32B | 32.8B | 19.9 GB | 32 GB | Reasoning |
| Granite 4.0 H Small | 32B (A9B) | 19.4 GB | 32 GB | Chat, Coding |
| Nemotron 3 Nano 30B-A3B | 31.6B (A3.6B) | 19.2 GB | 32 GB | Chat, Reasoning, Coding |
| Gemma 4 31B | 30.7B | 18.6 GB | 32 GB | Chat, Coding, Reasoning, Vision |
| Qwen 3 30B-A3B | 30.5B (A3.3B) | 18.5 GB | 32 GB | Chat, Reasoning |
| Qwen3-VL 30B-A3B | 30B (A3B) | 18.2 GB | 32 GB | Vision, Chat, Reasoning |
| Gemma 3 27B | 27.4B | 16.6 GB | 24 GB | Chat, Vision |
| Qwen 3.5 27B | 27B | 16.4 GB | 24 GB | Chat, Reasoning, Coding, Vision |
| Qwen 3.6 27B | 27B | 16.4 GB | 24 GB | Chat, Reasoning, Coding, Vision |
| Gemma 4 26B A4B | 25.2B (A3.8B) | 15.3 GB | 24 GB | Chat, Coding, Reasoning, Vision |
| Mistral Small 3.1 24B | 24B | 14.6 GB | 24 GB | Chat, Vision |
| Devstral 24B | 24B | 14.6 GB | 24 GB | Coding |
| Magistral Small 1.2 | 24B | 14.6 GB | 24 GB | Reasoning, Chat, Vision |
| Devstral Small 2 24B | 24B | 14.6 GB | 24 GB | Coding, Chat, Vision |
| Codestral 22B | 22.2B | 13.5 GB | 24 GB | Coding |
| GPT-OSS 20B | 20.9B (A3.6B) | 12.7 GB | 24 GB | Chat, Reasoning |
| Phi-4 Reasoning Vision 15B | 15B | 9.1 GB | 16 GB | Vision, Reasoning |
| Qwen 3 14B | 14.8B | 9.0 GB | 16 GB | Chat, Reasoning |
| DeepSeek R1 14B | 14.8B | 9.0 GB | 16 GB | Reasoning |
| Phi-4 14B | 14.7B | 8.9 GB | 16 GB | Chat, Reasoning |
| Ministral 3 14B | 14B | 8.5 GB | 16 GB | Chat, Vision |
| OLMo 2 13B | 13.7B | 8.3 GB | 12 GB | Chat |
| Gemma 3 12B | 12.2B | 7.4 GB | 12 GB | Chat, Vision |
| Mistral Nemo 12B | 12.2B | 7.4 GB | 12 GB | Chat |
| Gemma 4 12B | 12B | 7.3 GB | 12 GB | Chat, Coding, Reasoning, Vision |
| Mellum 2 12B-A2.5B | 12B (A2.5B) | 7.3 GB | 12 GB | Coding |
| Qwen 3.5 9B | 9B | 5.5 GB | 12 GB | Chat, Reasoning, Vision |
| GLM-4.6V-Flash | 9B | 5.5 GB | 12 GB | Vision, Chat |
| Qwen 2.5 VL 7B | 8.3B | 5.0 GB | 8 GB | Vision, Chat |
| Qwen 3 8B | 8.2B | 5.0 GB | 8 GB | Chat, Reasoning |
| Granite 3.3 8B | 8.2B | 5.0 GB | 8 GB | Chat |
| Llama 3.1 8B | 8B | 4.9 GB | 8 GB | Chat |
| DeepSeek R1 8B | 8B | 4.9 GB | 8 GB | Reasoning |
| Gemma 4 E4B | 8B (A4.5B) | 4.9 GB | 8 GB | Chat, Vision |
| Qwen3-VL 8B | 8B | 4.9 GB | 8 GB | Vision, Chat |
| Ministral 3 8B | 8B | 4.9 GB | 8 GB | Chat, Vision |
| Gemma 3n E4B | 7.8B (A4B) | 4.7 GB | 8 GB | Chat, Vision |
| Qwen 2.5 Coder 7B | 7.6B | 4.6 GB | 8 GB | Coding |
| DeepSeek R1 7B | 7.6B | 4.6 GB | 8 GB | Reasoning |
| Mistral 7B | 7.2B | 4.4 GB | 8 GB | Chat |
| Gemma 4 E2B | 5.1B (A2.3B) | 3.1 GB | 6 GB | Chat, Vision |
| Gemma 3 4B | 4.3B | 2.6 GB | 6 GB | Chat, Vision |
| Qwen 3 4B | 4B | 2.4 GB | 6 GB | Chat, Reasoning |
| Qwen 3.5 4B | 4B | 2.4 GB | 6 GB | Chat, Vision |
| Phi-4 Mini 3.8B | 3.8B | 2.3 GB | 6 GB | Chat |
| Llama 3.2 3B | 3.2B | 1.9 GB | 4 GB | Chat |
| DeepSeek-OCR | 3B (A0.57B) | 1.8 GB | 4 GB | Vision |
| Ministral 3 3B | 3B | 1.8 GB | 4 GB | Chat, Vision |
| DeepSeek R1 1.5B | 1.8B | 1.1 GB | 3 GB | Reasoning |
| Qwen 3 1.7B | 1.7B | 1.0 GB | 3 GB | Chat |
| SmolLM2 1.7B | 1.7B | 1.0 GB | 3 GB | Chat |
| Llama 3.2 1B | 1.2B | 0.7 GB | 3 GB | Chat |
| Gemma 3 1B | 1B | 0.6 GB | 3 GB | Chat |
| Qwen 3 0.6B | 0.6B | 0.4 GB | 2 GB | Chat |
Sizes are 4-bit (Q4_K_M) GGUF builds β the standard for running models locally. Β· Data updated: 2026-06-11 Β· How we calculate these numbers β
Just out of reach β needs 64 GB
These models don't fit comfortably in 32 GB but run on the next tier up.
Llama 3.1 70B Β· 64 GBLlama 3.3 70B Β· 64 GBDeepSeek R1 70B Β· 64 GBQwen3-Next 80B-A3B Β· 64 GBQwen3 Coder Next 80B-A3B Β· 64 GB
See the 64 GB tier β