Can I run this LLM? Real file sizes, live from Hugging Face.

Which GPU should I buy to run LLMs locally? (2026)

Pick any model — we show the cheapest hardware that runs it, from measured GGUF sizes at the recommended quant. Prices are street/used-market approximations (USD), refreshed monthly.

Cheapest hardware by memory tier (static table)

HardwareUsable VRAMStreet priceRuns (recommended quant, 8K)
Used RTX 3070 8GB7 GB~$220LFM2.5-2.6B, cohere-transcribe-03-2026
New RTX 4060 8GB7 GB~$280LFM2.5-2.6B, cohere-transcribe-03-2026
Used RTX 3060 12GB11 GB~$250Ternary-Bonsai-2-27B, Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
Used RTX 3080 12GB11 GB~$380Ternary-Bonsai-2-27B, Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
Used RTX 4070 12GB11 GB~$430Ternary-Bonsai-2-27B, Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
New RTX 4060 Ti 16GB15 GB~$420Ternary-Bonsai-2-27B, gemma-4-E4B-it
New RTX 5080 16GB15 GB~$1000Ternary-Bonsai-2-27B, gemma-4-E4B-it
Used RTX 3090 24GB22 GB~$650Qwen3.8-27B, Ternary-Bonsai-2-27B
Used RTX 4090 24GB22 GB~$1600Qwen3.8-27B, Ternary-Bonsai-2-27B
New RTX 5090 32GB29 GB~$2500Qwen3.8-27B, Ternary-Bonsai-2-27B
MacBook Air 16GB (M-series)11 GB~$1000Ternary-Bonsai-2-27B, Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
MacBook Pro 24GB17 GB~$1600Ternary-Bonsai-2-27B, gemma-4-E4B-it
MacBook Pro Max 64GB44 GB~$3200Qwen3.8-27B, Ternary-Bonsai-2-27B
Mac Studio Ultra 256GB177 GB~$6000Qwen3.8-27B, Ternary-Bonsai-2-27B

Usable = physical × 0.92 (fragmentation headroom); Macs × 0.75 (macOS wired limit). Two cheap 3090s (48GB pooled, ~$1300) beat one 4090 for models needing 25-48GB if your board has 2× x8 slots.

Doesn't fit your machine? Rent a GPU by the hour instead — a 24GB RTX 4090 starts around $0.30-0.50/h (Vast.ai, RunPod), or use the model via a hosted API. Buying instead? Which GPU should I buy? →
Share this page: 𝕏 Post Reddit Hacker News Telegram WhatsApp More…