Leaderboard · updated October 8, 2026

Best local LLM for every task

Each task publishes its own requirements — capability mix, context floor, licence and latency sensitivity — and the catalogue is ranked against them. Pick a task, then cap it to the memory you have.

Coding159 modelsQwen3-Coder 8Bleads · 96.3Full ranking →
General assistant159 modelsQwen 3 8Bleads · 96.1Full ranking →
Reasoning157 modelsGemma 4 27B ⭐leads · 98.2Full ranking →
RAG159 modelsGemma 4 31Bleads · 95.2Full ranking →
Agents55 modelsTernary Bonsai 27Bleads · 91.7Full ranking →
Writing159 modelsGemma 3 27B Instructleads · 94.2Full ranking →
Research157 modelsGemma 4 31Bleads · 95.7Full ranking →
Mathematics157 modelsQwen 3 32Bleads · 100Full ranking →
Document analysis159 modelsGemma 4 31Bleads · 95.2Full ranking →
Summarization159 modelsGemma 4 31Bleads · 94.6Full ranking →
Translation159 modelsGLM-4 9Bleads · 96.1Full ranking →
Vision53 modelsQwen 3.7 35B-A3Bleads · 95.5Full ranking →
OCR53 modelsGemma 4 27B ⭐leads · 93.7Full ranking →
Enterprise assistant159 modelsGemma 4 31Bleads · 96Full ranking →
Privacy159 modelsGPT-OSS 20Bleads · 93.4Full ranking →
Offline AI159 modelsTernary Bonsai 27Bleads · 93.5Full ranking →
Cybersecurity159 modelsQwen 3.7 35B-A3Bleads · 99.5Full ranking →
Fine-tuning159 modelsQwen 3.7 35B-A3Bleads · 92.8Full ranking →
Decision models15 models · not ranked: they return a choice or a score, not chat. Compare by size and fit instead.Open the guide →Build a request →
CodingFits inAny size
25 of 80 ranked
#ModelCoding scoreVRAM Q4
1Qwen 3 32B
32B
95.420.6 GB
2Qwen 3.6 35B-A3B
35B (3B active)
95.221.9 GB
3Devstral Small 2 24B
24B
94.915.3 GB
4DeepSeek R1 Distill Qwen 32B
32B
94.920.1 GB
5Gemma 4 31B
31B
94.819.5 GB
6Qwen3.8 27B
27B
93.717.6 GB
7GLM-4.7-Flash 30B-A3B
30B (3B active)
92.818.9 GB
8North Mini Code 1.0 30B-A3B
30B (3B active)
92.718.9 GB
9Poolside Laguna XS 2.1 Laguna XS 2.1 33B-A3B
33B (3B active)
9220.7 GB
10Ternary Bonsai 27B
27B
91.517.1 GB
11Qwen3-Coder-Next (80B-A3B MoE)
80B/3B active
91.349.1 GB
12IBM Granite 4.1 Granite 4.1 8B
8B
91.15.6 GB
13Qwen 3.5 35B-A3B
35B (3B active)
90.921.9 GB
14GLM-5 744B
744B
90.7450 GB
15Mistral Small 3.2 24B
24B
90.615 GB
16Llama 3.3 70B Instruct
70B
90.643.1 GB
17Magistral Small 24B
24B
90.415.3 GB
18Mistral Small 3.1 24B
24B
90.315 GB
19Cogito v1 32B
32B
90.320.1 GB
20Nex-N2 mini
35B (3B active)
90.221.9 GB
21Gemma 3 27B Instruct
27B
9017.1 GB
22Ministral 3 14B
14B
89.99.3 GB
23K2 Horizon MoVA 36B-A4B
36B (4B active)
89.423.4 GB
24DeepSeek V4.1 Flash
284B (13B active)
89.4172.3 GB
25DeepSeek V4-Flash
284B (13B active)
89.1172.3 GB

Speed is estimated for the NVIDIA GeForce RTX 4090. Scores are 0–100 task scores from published evaluations and vendor figures, normalised by us. Methodology.