BestLLMfor EN Your hardware. Your LLM. Your call.
APIOpen data Find my LLM
Updated 2026-06-29

The Local LLM Leaderboard.

Every locally-runnable LLM, ranked by a transparent composite score across 34 benchmarked models.

Comparing two models? Use /compare/. Picking by hardware or task? See /best/. Cloud-vs-local cost? The cost calculator. Download the data: CSV · JSON (CC BY 4.0).

Local LLM Leaderboard 2026 — ranked by composite score (higher is better). Click a header to sort.
#ModelScoreParamsMin VRAM (Q4)LicenseContextKey benchmark
1Phi-4 14BPhi69.114B9 GBMIT16KMMLU 85
2Qwen 2.5 7BQwen67.07B5 GBApache 2.0131KMMLU 74
3Granite 4.1 8B InstructGranite66.58B5 GBApache 2.0131KMMLU 74
4Qwen 2.5 3B InstructQwen65.83B2 GBQwen Research License32KMMLU 66
5Qwen 2.5 14B InstructQwen65.714B9 GBApache 2.0131KMMLU 80
6DeepSeek R1 671BDeepSeek63.0671B400 GBMIT128KMMLU 91
7SmolLM3 3BSmolLM61.63B2 GBApache 2.0128KMMLU 60
8Mistral Small 3.1 24BMistral61.424B14 GBApache 2.0128KMMLU 81
9Llama 3.1 8BLlama60.58B6 GBLlama 3 Community131KMMLU 73
10Qwen 2.5 32BQwen60.532B19 GBApache 2.0131KMMLU 83
11Mistral Small 3Mistral59.924B14 GBApache 2.032KMMLU 81
12Llama 3.2 3BLlama59.53B2 GBLlama 3 Community131KMMLU 63
13Granite 3.2 8B InstructGranite57.58B5 GBApache 2.0128KMMLU 67
14Llama 3.1 405B InstructLlama57.5405B240 GBLlama 3.1 Community128KMMLU 89
15Llama 3.1 70BLlama55.970B40 GBLlama 3 Community131KMMLU 86
16Llama 3.3 70B InstructLlama55.970B40 GBLlama 3.3 Community128KMMLU 86
17Qwen 2.5 72B InstructQwen55.972B42 GBQwen License131KMMLU 86
18Mistral Nemo 12B InstructMistral55.812B7 GBApache 2.0128KMMLU 68
19Gemma 3 27BGemma55.427B16 GBGemma128KMMLU 79
20Falcon 3 10B InstructFalcon54.610B6 GBTII Falcon-LLM License 2.032KMMLU 73
21Gemma 2 9BGemma54.39B6 GBGemma8KMMLU 71
22Falcon 3 7B InstructFalcon53.17B5 GBTII Falcon-LLM License 2.032KMMLU 70
23Phi-3.5 MiniPhi51.83.8B10 GBMIT131KMMLU 69
24Phi-4 Mini 3.8BPhi49.73.8B10 GBMIT128KMMLU 67
25Yi 1.5 34B ChatYi48.034B20 GBApache 2.04KMMLU 77
26Mixtral 8x22B InstructMistral47.4141B82 GBApache 2.064KMMLU 78
27Gemma 2 27BGemma47.327B16 GBGemma8KMMLU 75
28Mistral 7B InstructMistral46.47B5 GBApache 2.032KMMLU 60
29Gemma 2 2BGemma45.32B1 GBGemma8KMMLU 52
30Falcon Mamba 7BFalcon39.97B5 GBTII Falcon-LLM License 2.08KMMLU 62
31Mixtral 8x7BMistral39.547B26 GBApache 2.032KMMLU 71
32OLMoE 1B-7B InstructOLMo34.87B4 GBApache 2.04KMMLU 52
33DBRX InstructDBRX34.7132B76 GBDatabricks Open Model License32KMMLU 74
34Snowflake Arctic InstructArctic30.7480B290 GBApache 2.04KMMLU 67
Lucie 7BLucien/a7B5 GBApache 2.04K
CroissantLLM 1.3BCroissantn/a1.3B1 GBMIT2K
Qwen 2.5 Coder 7BQwenn/a7B5 GBApache 2.0131K
Qwen 2.5 Coder 32BQwenn/a32B19 GBApache 2.0131K
DeepSeek R1 Distill 7BDeepSeekn/a7B5 GBMIT32K
DeepSeek R1 Distill 32BDeepSeekn/a32B19 GBMIT32K
DeepSeek Coder V2 Lite 16BDeepSeekn/a16B10 GBMIT131K
Llama 3.2 Vision 11BLlaman/a11B8 GBLlama 3 Community131K
Qwen 2 VL 7BQwenn/a7B6 GBApache 2.032K
Qwen 3 8BQwenn/a8B5 GBApache 2.0131K
Qwen 3 14BQwenn/a14B9 GBApache 2.0131K
Qwen 3 32BQwenn/a32B19 GBApache 2.0131K
Qwen 3 235B-A22BQwenn/a235B142 GBApache 2.0131K
Qwen 2.5 VL 7BQwenn/a7B6 GBApache 2.0128K
Qwen 2.5 VL 72BQwenn/a72B42 GBQwen License128K
Qwen 2.5 Omni 7BQwenn/a7B6 GBApache 2.032K
QwQ 32BQwenn/a32B19 GBApache 2.0131K
DeepSeek R1 Distill Llama 70BDeepSeekn/a70B40 GBLlama 3.3 Community + DeepSeek128K
DeepSeek V3 671BDeepSeekn/a671B400 GBDeepSeek License128K
Gemma 3 4BGemman/a4B10 GBGemma128K
Gemma 3 12BGemman/a12B7 GBGemma128K
Phi-4 Multimodal 5.6BPhin/a5.6B4 GBMIT128K
Phi-4 Reasoning 14BPhin/a14B9 GBMIT32K
Command R+ 104B (08-2024)Commandn/a104B60 GBCC-BY-NC 4.0128K
Aya Expanse 8BAyan/a8B5 GBCC-BY-NC 4.08K
Aya Expanse 32BAyan/a32B19 GBCC-BY-NC 4.08K
EuroLLM 9B InstructEuroLLMn/a9B6 GBApache 2.04K
Teuken 7B InstructTeukenn/a7B5 GBApache 2.0 (commercial)4K
Pleias 3B PreviewPleiasn/a3B2 GBApache 2.02K
Pleias-RAG 1BPleiasn/a1.2B0 GBApache 2.02K
Moshi 7BMoshin/a7.6B5 GBCC-BY 4.04K
Helium 1 2BHeliumn/a2B1 GBCC-BY-SA 4.04K
SmolLM2 1.7B InstructSmolLMn/a1.7B1 GBApache 2.08K
SmolVLM2 2.2B InstructSmolLMn/a2.2B1 GBApache 2.08K
GLM-5.1GLMn/a744B445 GBMIT200K
MiniMax-M2.7MiniMaxn/a229B138 GBApache 2.0205K
Gemma 4 31BGemman/a31B18 GBGemma256K
Gemma 4 E4BGemman/a4B10 GBGemma128K
Qwen 3.5 9BQwenn/a9B6 GBApache 2.0262K
Qwen 3.5 27BQwenn/a27B16 GBApache 2.0262K
Qwen 3.5 397B-A17BQwenn/a397B240 GBApache 2.0262K
Qwen 3.6 35B-A3BQwenn/a35B21 GBApache 2.0262K
Qwen3-Coder-Next 80B-A3BQwenn/a80B48 GBApache 2.0262K
Mistral Small 4Mistraln/a119B72 GBApache 2.0256K
Devstral Small 2 24BMistraln/a24B14 GBApache 2.0256K
Voxtral-4B-TTSMistraln/a4B10 GBCC-BY-NC 4.04K
DeepSeek R2 32BDeepSeekn/a32B19 GBMIT128K
DeepSeek V3.2DeepSeekn/a685B410 GBMIT128K
Kimi K2.5Kimin/a1000B600 GBModified MIT256K
Nemotron 3 Super 120BNemotronn/a120B72 GBNVIDIA Open Model License128K
OLMo 3 7BOLMon/a7B5 GBApache 2.08K
OLMo 3 32BOLMon/a32B19 GBApache 2.065K
Tiny Aya 3.35BAyan/a3.35B2 GBCC-BY-NC 4.08K
Granite 4.0 3B VisionGraniten/a3B2 GBApache 2.016K
Step 3.5 FlashStepn/a196B118 GBApache 2.0256K
Falcon H1R 7BFalconn/a7B5 GBTII Falcon-LLM License 2.032K
Mistral Small 3.2 24BMistraln/a24B14 GBApache 2.0128K
Codestral 22B v0.1Mistraln/a22B13 GBMistral Non-Production License32K
Codestral Mamba 7BMistraln/a7B5 GBApache 2.0256K
Magistral Small 24BMistraln/a24B14 GBApache 2.0128K
Mistral Large 3 675BMistraln/a675B405 GBApache 2.0256K
Mistral Medium 3.5 128BMistraln/a128B74 GBModified MIT256K
Llama 4 Scout 109BLlaman/a109B65 GBLlama 4 Community10000K
Llama 4 Maverick 400BLlaman/a400B240 GBLlama 4 Community1000K
Llama 3.1 Nemotron 70BNemotronn/a70B40 GBLlama 3.1 Community128K
Qwen 2.5 Coder 1.5B InstructQwenn/a1.5B1 GBApache 2.032K
Qwen 2.5 Coder 3B InstructQwenn/a3B2 GBQwen Research License32K
Qwen 2.5 Coder 14B InstructQwenn/a14B9 GBApache 2.0131K
Qwen 3 30B-A3BQwenn/a30B19 GBApache 2.0131K
DeepSeek R1 Distill Qwen 1.5BDeepSeekn/a1.5B1 GBMIT131K
DeepSeek R1 Distill Qwen 14BDeepSeekn/a14B9 GBMIT131K
Phi-4 Mini Reasoning 3.8BPhin/a3.8B10 GBMIT128K
Gemma 3n E2BGemman/a2B2 GBGemma32K
Gemma 3n E4BGemman/a4B4 GBGemma32K
Granite 3.3 8B InstructGraniten/a8B5 GBApache 2.0128K
Granite 4.0 H-Small 32B-A9BGraniten/a32B19 GBApache 2.0128K
Granite 4.0 H-Tiny 7B-A1BGraniten/a7B4 GBApache 2.0128K
Tülu 3 8BTulun/a8B6 GBLlama 3.1 Community128K
Tülu 3 70BTulun/a70B40 GBLlama 3.1 Community128K
Molmo 7B-DMolmon/a7B5 GBApache 2.04K
Molmo 72BMolmon/a72B42 GBApache 2.04K
MiniCPM-V 2.6 8BMiniCPMn/a8B5 GBMiniCPM Model License32K
MiniCPM-o 2.6 8BMiniCPMn/a8B5 GBMiniCPM Model License32K
Command R 35B v01Commandn/a35B20 GBCC-BY-NC 4.0128K
Aya 23 8BAyan/a8B5 GBCC-BY-NC 4.08K
Aya 23 35BAyan/a35B20 GBCC-BY-NC 4.08K
Yi Coder 9B ChatYin/a9B5 GBApache 2.0128K
Jais 30B Chat v3Jaisn/a30B18 GBApache 2.08K
Jais Adapted 70B ChatJaisn/a70B40 GBApache 2.04K
Sarvam-M 24BSarvamn/a24B14 GBApache 2.032K
Salamandra 7B InstructSalamandran/a7.7B5 GBApache 2.08K
Salamandra 40B InstructSalamandran/a40B24 GBApache 2.08K
EuroLLM 22B Instruct 2512EuroLLMn/a22.6B13 GBApache 2.032K
Claire 7B 0.1Clairen/a7B5 GBCC-BY-NC-SA 4.02K
Jamba 1.5 MiniJamban/a52B30 GBJamba Open Model License256K
Hunyuan-A13B InstructHunyuann/a80B48 GBTencent Hunyuan License262K
LLaVA-OneVision 7BLLaVAn/a7B5 GBApache 2.032K
LLaVA-OneVision 72BLLaVAn/a72B42 GBApache 2.032K
Grok-1 (base)Grokn/a314B188 GBApache 2.08K
gpt-oss 120Bgpt-ossn/a117B70 GBApache 2.0128K
gpt-oss 20Bgpt-ossn/a21B13 GBApache 2.0128K
Kimi K2.6Kimin/a1000B600 GBModified MIT256K
Qwen 3 VL 235B-A22BQwenn/a235B142 GBApache 2.0262K
Qwen 3 VL 30B-A3BQwenn/a30B19 GBApache 2.0262K
Qwen 3 VL 8BQwenn/a8B6 GBApache 2.0262K
ERNIE 4.5 300B-A47BERNIEn/a300B180 GBApache 2.0131K
ERNIE 4.5 21B-A3B ThinkingERNIEn/a21B13 GBApache 2.0131K
Ring-1TRingn/a1000B600 GBMIT131K
Seed-OSS 36B InstructSeedn/a36B22 GBApache 2.0524K
EXAONE 4.5 33BEXAONEn/a33B20 GBEXAONE AI Model License262K
Nemotron Nano 3 30B-A3BNemotronn/a30B19 GBNVIDIA Open Model License1000K
Nemotron Nano v2 VL 12BNemotronn/a12.6B8 GBNVIDIA Open Model License128K
Apertus 70BApertusn/a70B40 GBApache 2.065K
Apertus 8BApertusn/a8B6 GBApache 2.065K
Trinity Mini 26B-A3BTrinityn/a26B15 GBApache 2.0131K
Hunyuan Large 2.0Hunyuann/a406B245 GBTencent Hunyuan License262K
InternVL 3.5 8BInternVLn/a8B6 GBApache 2.032K
MiMo V2 FlashMiMon/a309B185 GBMIT128K
Rakuten AI 3.0Rakutenn/a700B420 GBApache 2.032K
Kanana 2 30B-A3B ThinkingKananan/a30B18 GBApache 2.0131K
DeepSeek-OCRDeepSeekn/a3B2 GBMIT8K
HunyuanOCR 1BHunyuann/a1B0 GBTencent Hunyuan License8K
Gemma 4 26B-A4B MoEGemman/a26B16 GBGemma128K
dots.llm1 Instructdotsn/a142B85 GBMIT32K
Qwen 3 Omni 30B-A3BQwenn/a30B19 GBApache 2.0131K
Qwen 3.5 122B-A10BQwenn/a122B73 GBApache 2.0262K
Pangu Pro MoE 72BPangun/a72B42 GBPangu Model License32K
Qwen 3.6 27BQwenn/a27B16 GBApache 2.0262K
DeepSeek V4 Pro 1.6TDeepSeekn/a1600B960 GBMIT1000K
DeepSeek V4 Flash 284BDeepSeekn/a284B170 GBMIT1000K
Tencent Hy3 Preview 295BHunyuann/a295B177 GBTencent Hunyuan License256K
LLaDA 2.0 Uni 16BLLaDAn/a16B18 GBApache 2.08K
MiMo V2.5 ProMiMon/a1020B595 GBMIT1000K
MiMo V2.5MiMon/a310B180 GBMIT1000K
Nemotron 3 Nano Omni 30B-A3BNemotronn/a30B21 GBNVIDIA Open Model License256K
Laguna XS.2Lagunan/a33B19 GBApache 2.0131K
Granite 4.1 30B InstructGraniten/a30B17 GBApache 2.0131K
Granite 4.1 3B InstructGraniten/a3B2 GBApache 2.0131K
Ling 2.6 1TLingn/a1000B580 GBMIT262K
Gemma 4 E2BGemman/a2B7 GBGemma128K
Nemotron Cascade 2 30B-A3BNemotronn/a30B17 GBNVIDIA Open Model License128K
Nemotron 3 33BNemotronn/a33B19 GBNVIDIA Open Model License128K
Nemotron 3 Nano 30B-A3BNemotronn/a30B17 GBNVIDIA Open Model License128K
MedGemma 4BGemman/a4B2 GBGemma128K
Gemma 4 2BGemman/a2B1 GBGemma128K
Qwen 3.5 0.8BQwenn/a0.8B0 GBApache 2.0256K
MedGemma 1.5 4BGemman/a4B2 GBGemma128K
Granite 4.1Graniten/a3B1 GBApache 2.0128K
Qwen 3.6 27BQwenn/a27B16 GBQwen License256K
LFM2.5 Thinking 1.2BLFMn/a1.2B0 GBLFM Open License v1.032K
GLM 4.7 FlashGLMn/a3B1 GBMIT128K

How this leaderboard is scored

Every model is rated 0–100 on a weighted composite: 45% quality (the MMLU benchmark), 25% efficiency (benchmark score per GB of VRAM — the metric that matters when the model runs on your hardware), 15% accessibility (does it fit 8/12/16/24 GB?), 10% license (can you use it commercially?) and 5% context window. Each sub-metric is min–max normalized across the 34 models tracked, so scores are relative to this set and recomputed on every update. VRAM figures and the efficiency metric assume a Q4_K_M quantization. Benchmark scores are sourced from each model’s published results (see its catalog page); models without the headline benchmark are listed as n/a and ranked last, never imputed. Full data: CSV / JSON under CC BY 4.0 — corrections welcome.

FactorWeightWhat it measures
Quality45%MMLU benchmark (normalized)
Efficiency25%Benchmark per GB of VRAM
Accessibility15%Fits 8/12/16/24 GB VRAM
License10%Commercial-use freedom
Context5%Usable context window
Cite this

bestllmfor.com — Local LLM Leaderboard 2026, https://bestllmfor.com/leaderboard/ (CC BY 4.0)

@misc{bestllmfor_local_llm_leaderboard_2026,
  author       = {Meguedmi, Mohamed},
  title        = {Local LLM Leaderboard 2026},
  howpublished = {\url{https://bestllmfor.com/leaderboard/}},
  year         = {2026},
  note         = {bestllmfor.com, CC BY 4.0}
}

Free to reuse with attribution. Please link to https://bestllmfor.com/leaderboard/.