CompareLLM
CompareLLM.ai
Live
Leaderboard
Models
Compare
Best of & Stacks
Research & News
…
CompareLLM
CompareLLM.ai
Precision Benchmarks

Programmatic, dated AI model benchmarks, head-to-head comparisons, and Stack Engine presets.

Daily ingest · 06:00 UTC

Analytics & Benchmarks

  • AI Model Leaderboard
  • Head-to-Head Compare Hub
  • Models Directory
  • Stack Engine Presets
  • Frontier Models
  • Open Weights Catalog

Guides & Intent Lists

  • Best LLM Lists (2026)
  • Best Coding LLM
  • Best Cheap LLM
  • Fastest Low-Latency LLM
  • Claude vs GPT Benchmark
  • What is Elo?
  • Methodology Guides
  • News & Dispatches

Transparency & API

  • Evaluation Methodology
  • Benchmark Changelog
  • Public JSON API
  • llms.txt Specification
  • Privacy Policy
  • Sign In / Account

© 2026 CompareLLM. Public benchmark data aggregated from Arena Elo, LiveBench, SWE-bench & OpenRouter.

Every score has a dated snapshot.

Theme:
Currency:
  1. Home
  2. Best lists
  3. best local llm
Search Intent · best local llm

Best local / open-weight LLM in 2026

Open-weight rows you can self-host. Not a laptop VRAM guide — check the license and your box.

Quick answer

DeepSeek V4 Pro is the current #1 for “best local llm” on this dated Stack Engine mix. Highest reasoning signal among models you can self-host or buy as open weights. Weights: Elo 30%, LiveBench 30%, GPQA 25%, Out $ 15%.
Weights:Elo 30%LiveBench 30%GPQA 25%Out $ 15%
Current #1 Ranked PickScore 73.9 / 100

DeepSeek V4 Pro

DeepSeek · Open weights

Elo: 1,536 (Top 22%)LiveBench: 70.1% (Top 17%)GPQA: 84% (Top 18%)Out $: $3.96/1M (Top 66%)
SWE-bench: 71.6%Elo: 1,536
View full model fact sheet

Complete Ranked Category List

Models ranked by verified benchmark weights across SWE-bench and coding preference evaluations.

#1DeepSeek V4 Pro(DeepSeek)
Score 73.9
Elo: 1,536 (Top22%)LiveBench: 70.1% (Top17%)GPQA: 84% (Top18%)Out $: $3.96/1M (Top66%)
🏆 #1 Overall Leader in Category
#2DeepSeek V4 Flash(DeepSeek)
Score 70.4
Elo: 1,490 (Top38%)LiveBench: 67.8% (Top28%)GPQA: 81.6% (Top29%)Out $: $0.28/1M (Top17%)
Rank #2vs #1
#3Qwen QwQ 32B(Alibaba)
Score 70.0
Elo: 1,495 (Top33%)LiveBench: 68% (Top27%)GPQA: 83.2% (Top23%)Out $: $1.2/1M (Top42%)
Rank #3vs #1
#4GLM-5.2(Zhipu)
Score 58.0
Elo: 1,492 (Top35%)LiveBench: 65.2% (Top40%)GPQA: 79.5% (Top39%)Out $: $3.74/1M (Top65%)
Rank #4vs #1
#5MiniMax M2.5(MiniMax)
Score 53.5
Elo: 1,478 (Top42%)LiveBench: 64.4% (Top47%)GPQA: 76.2% (Top58%)Out $: $0.9/1M (Top35%)
Rank #5vs #1
#6Llama 4 Maverick(Meta)
Score 46.9
Elo: 1,468 (Top49%)LiveBench: 62.8% (Top58%)GPQA: 74.6% (Top64%)Out $: $0.8/1M (Top33%)
Rank #6vs #1
#7Qwen3 235B(Alibaba)
Score 45.5
Elo: 1,440 (Top60%)LiveBench: 63.5% (Top54%)GPQA: 76.8% (Top51%)Out $: $1.82/1M (Top50%)
Rank #7vs #1
#8Qwen 2.5 Coder 32B(Alibaba)
Score 45.1
Elo: 1,425 (Top65%)LiveBench: 64.8% (Top44%)GPQA: 74% (Top70%)Out $: $0.72/1M (Top31%)
Rank #8vs #1
#9DeepSeek R1(DeepSeek)
Score 35.8
Elo: 1,358 (Top80%)LiveBench: 59% (Top74%)GPQA: 79.8% (Top36%)Out $: $2.5/1M (Top60%)
Rank #9vs #1
#10Llama 4 Scout(Meta)
Score 34.7
Elo: 1,412 (Top69%)LiveBench: 59.6% (Top73%)GPQA: 71.2% (Top80%)Out $: $0.3/1M (Top18%)
Rank #10vs #1
#11Llama 3.1 405B(Meta)
Score 32.8
Elo: 1,370 (Top74%)LiveBench: 61.2% (Top65%)GPQA: 75.2% (Top63%)Out $: $3.5/1M (Top65%)
Rank #11vs #1
#12DeepSeek Coder V2(DeepSeek)
Score 31.6
Elo: 1,365 (Top76%)LiveBench: 58.6% (Top76%)GPQA: 70.2% (Top81%)Out $: $0.28/1M (Top17%)
Rank #12vs #1

Frequently asked questions

Plain-English methodology and leaderboard answers

DeepSeek V4 Pro is the current #1 on this list. Rankings move when daily ingest updates SWE-bench, Elo, price, or latency.

What is preference Elo? · How rankings update