Can I run this LLM? Real file sizes, live from Hugging Face.

What LLM can I run? Pick your VRAM / RAM

Type your GPU VRAM (or usable system RAM for CPU inference). Every model that fits is listed with its best quant — computed from measured GGUF file sizes, 8K context, ~8% headroom. Data refreshes daily from Hugging Face.

Popular tiers

8GB VRAMranked picks12GB VRAMranked picks16GB VRAMranked picks24GB VRAMranked picks32GB VRAMranked picks48GB VRAMranked picks64GB VRAMranked picks96GB VRAMranked picks