Explore local AI: GPUs, models & best-of guides
Every graphics card, every open-weight model, and hand-picked best-of guides — each with real, computed analysis of what runs, how fast, and at which quantization.
Best-of guides
The best local LLMs for coding
The best local LLMs for reasoning
The best local LLMs for math
The best local LLMs for general chat & writing
The best local LLMs for multilingual & translation
The best local LLMs for agents & tool use
The best local LLMs for vision & OCR
The best LLMs for 8GB of VRAM
The best LLMs for 12GB of VRAM
The best LLMs for 16GB of VRAM
The best LLMs for 24GB of VRAM
The best LLMs for 32GB of VRAM
The best LLMs for 48GB of VRAM
GPU comparisons
GeForce RTX 4070 vs GeForce RTX 4070 SUPERGeForce RTX 4070 SUPER vs GeForce RTX 5070GeForce RTX 4070 vs GeForce RTX 5070GeForce RTX 3060 12GB vs GeForce RTX 4060GeForce RTX 4060 vs GeForce RTX 4070GeForce RTX 4060 vs Intel Arc B580GeForce RTX 4070 Ti SUPER vs GeForce RTX 4080 SUPERGeForce RTX 4080 SUPER vs GeForce RTX 4090GeForce RTX 5070 vs GeForce RTX 5070 TiGeForce RTX 3090 vs GeForce RTX 4090GeForce RTX 4090 vs GeForce RTX 5090GeForce RTX 4090 vs GeForce RTX 5080GeForce RTX 5080 vs GeForce RTX 5090GeForce RTX 4090 vs Radeon RX 7900 XTXGeForce RTX 4070 vs Radeon RX 7800 XTGeForce RTX 5070 vs GeForce RTX 4090Apple M4 Pro vs Apple M4 MaxApple M3 Max (16c) vs GeForce RTX 4090Apple M2 Ultra vs GeForce RTX 4090GeForce RTX 4080 vs GeForce RTX 4080 SUPERGeForce RTX 3080 vs GeForce RTX 4070GeForce RTX 3070 vs GeForce RTX 4060GeForce RTX 4070 Ti vs GeForce RTX 4070 Ti SUPERRadeon RX 9070 XT vs GeForce RTX 5070Radeon RX 7900 GRE vs GeForce RTX 4070 Ti SUPERGeForce RTX 3060 12GB vs GeForce RTX 3060 TiApple M4 Max vs Apple M3 Max (16c)Apple M3 Ultra vs GeForce RTX 5090RTX A6000 vs GeForce RTX 4090GeForce RTX 3090 Ti vs GeForce RTX 4090GeForce RTX 5060 vs GeForce RTX 4060
Model comparisons
Qwen3 8B vs Llama 3.1 8BQwen3 14B vs Gemma 3 12BQwen3 14B vs DeepSeek-R1-Distill 14BQwen2.5-Coder 7B vs Qwen3 8BGemma 3 12B vs Mistral Nemo 12BQwen3 32B vs Qwen2.5-Coder 32BDeepSeek-R1-Distill 14B vs Phi-4 14BLlama 3.3 70B vs Qwen3 32BQwen3 30B-A3B (MoE) vs Qwen3 32BGemma 3 27B vs Mistral Small 3 24BQwen3 4B vs Llama 3.2 3BDeepSeek-R1-Distill 32B vs Qwen3 32BPhi-4 14B vs Qwen3 14BMistral Small 3 24B vs Qwen3 32BLlama 3.1 8B vs Gemma 3 12BQwen2.5-Coder 32B vs DeepSeek-R1-Distill 32BQwen3 8B vs Gemma 3 12BQwen2.5 72B vs Llama 3.3 70BQwen2.5 32B vs Qwen3 32BGemma 2 27B vs Gemma 3 27BQwen2.5-Coder 14B vs Qwen2.5-Coder 32BQwen2.5 7B vs Qwen3 8BCodestral 22B vs Qwen2.5-Coder 32BYi 1.5 34B vs Qwen2.5 32BAya Expanse 32B vs Gemma 3 27BMistral Large 2411 vs Qwen2.5 72BGemma 2 9B vs Llama 3.1 8BPhi-3.5 Mini 3.8B vs Qwen2.5 3B
Browse by GPU
GeForce RTX 5090
32GB · 1792 GB/s
GeForce RTX 5080
16GB · 960 GB/s
GeForce RTX 5070 Ti
16GB · 896 GB/s
GeForce RTX 5070
12GB · 672 GB/s
GeForce RTX 5060 Ti 16GB
16GB · 448 GB/s
GeForce RTX 4090
24GB · 1008 GB/s
GeForce RTX 4080 SUPER
16GB · 736 GB/s
GeForce RTX 4070 Ti SUPER
16GB · 672 GB/s
GeForce RTX 4070 SUPER
12GB · 504 GB/s
GeForce RTX 4070
12GB · 504 GB/s
GeForce RTX 4060 Ti 16GB
16GB · 288 GB/s
GeForce RTX 4060
8GB · 272 GB/s
GeForce RTX 3090
24GB · 936 GB/s
GeForce RTX 3080
10GB · 760 GB/s
GeForce RTX 3060 12GB
12GB · 360 GB/s
Radeon RX 7900 XTX
24GB · 960 GB/s
Radeon RX 7900 XT
20GB · 800 GB/s
Radeon RX 7800 XT
16GB · 624 GB/s
Radeon RX 7600
8GB · 288 GB/s
Intel Arc B580
12GB · 456 GB/s
Intel Arc A770 16GB
16GB · 560 GB/s
Apple M4 Max
48GB · 546 GB/s
Apple M4 Pro
24GB · 273 GB/s
Apple M4
16GB · 120 GB/s
Apple M3 Max (16c)
48GB · 400 GB/s
Apple M3 Pro
18GB · 150 GB/s
Apple M2 Ultra
64GB · 800 GB/s
Apple M2 Max
32GB · 400 GB/s
Apple M1 Max
32GB · 400 GB/s
Apple M1
8GB · 68 GB/s
GeForce RTX 4080
16GB · 717 GB/s
GeForce RTX 4070 Ti
12GB · 504 GB/s
GeForce RTX 4060 Ti 8GB
8GB · 288 GB/s
GeForce RTX 5060
8GB · 448 GB/s
GeForce RTX 3090 Ti
24GB · 1008 GB/s
GeForce RTX 3080 Ti
12GB · 912 GB/s
GeForce RTX 3080 12GB
12GB · 912 GB/s
GeForce RTX 3070 Ti
8GB · 608 GB/s
GeForce RTX 3070
8GB · 448 GB/s
GeForce RTX 3060 Ti
8GB · 448 GB/s
GeForce RTX 3050 8GB
8GB · 224 GB/s
RTX A6000
48GB · 768 GB/s
RTX 6000 Ada
48GB · 960 GB/s
Radeon RX 9070 XT
16GB · 640 GB/s
Radeon RX 7900 GRE
16GB · 576 GB/s
Radeon RX 7700 XT
12GB · 432 GB/s
Radeon RX 6950 XT
16GB · 576 GB/s
Radeon RX 6800 XT
16GB · 512 GB/s
Radeon RX 6700 XT
12GB · 384 GB/s
Intel Arc A750
8GB · 512 GB/s
Intel Arc B570
10GB · 380 GB/s
Apple M3 Ultra
96GB · 819 GB/s
Apple M1 Ultra
64GB · 800 GB/s
Apple M2 Pro
16GB · 200 GB/s
Apple M1 Pro
16GB · 200 GB/s
Apple M3
8GB · 100 GB/s
Apple M2
8GB · 100 GB/s
Browse by model
Qwen3 0.6B
0.6B · Qwen
Qwen3 1.7B
1.7B · Qwen
Qwen3 4B
4B · Qwen
Qwen3 8B
8B · Qwen
Qwen3 14B
14B · Qwen
Qwen3 32B
32B · Qwen
Qwen3 30B-A3B (MoE)
30.5B · Qwen
Qwen2.5-Coder 7B
7B · Qwen
Qwen2.5-Coder 32B
32B · Qwen
Llama 3.2 1B
1.2B · Llama
Llama 3.2 3B
3.2B · Llama
Llama 3.1 8B
8B · Llama
Llama 3.3 70B
70B · Llama
Gemma 3 1B
1B · Gemma
Gemma 3 4B
4B · Gemma
Gemma 3 12B
12B · Gemma
Gemma 3 27B
27B · Gemma
Mistral 7B v0.3
7.2B · Mistral
Mistral Nemo 12B
12B · Mistral
Mistral Small 3 24B
24B · Mistral
Phi-4 14B
14B · Phi
DeepSeek-R1-Distill 7B
7B · DeepSeek
DeepSeek-R1-Distill 14B
14B · DeepSeek
DeepSeek-R1-Distill 32B
32B · DeepSeek
Qwen2.5 3B
3.1B · Qwen
Qwen2.5 7B
7.6B · Qwen
Qwen2.5 14B
14.7B · Qwen
Qwen2.5 32B
32.5B · Qwen
Qwen2.5 72B
72.7B · Qwen
Qwen2.5-Coder 14B
14.7B · Qwen
Gemma 2 2B
2.6B · Gemma
Gemma 2 9B
9.2B · Gemma
Gemma 2 27B
27.2B · Gemma
Codestral 22B
22.2B · Mistral
Mistral Large 2411
123B · Mistral
StarCoder2 15B
16B · BigCode
Phi-3.5 Mini 3.8B
3.8B · Phi
SmolLM2 1.7B
1.7B · SmolLM
Command R7B
7B · Cohere
Aya Expanse 8B
8B · Cohere
Aya Expanse 32B
32B · Cohere
Yi 1.5 9B
8.8B · Yi
Yi 1.5 34B
34.4B · Yi
GLM-4 9B
9.4B · GLM
InternLM2.5 20B
20B · InternLM
DeepSeek-V2-Lite (MoE)
15.7B · DeepSeek
OLMo 2 13B
13.7B · AllenAI
Interactive estimator
LLM VRAM & speed estimator →
Free-form sliders — dial any model size + hardware and predict memory, tokens/sec, latency and batch throughput live.
Run the interactive advisor
Auto-detect your exact hardware and get personalised picks, speed & memory.