Your hardware
Detectingβ¦
2 / 4 / 6 / 8 / 12 / 16 / 20 / 24 / 32 / 48 / 64
Models that fit
Context: 8k tokens βΉ VRAM 0.0 GB
Best fits for your hardware
Nothing fits at this context/VRAM. Lower the context length or pick a smaller card.
| Model | Params | Rec. quant | VRAM needed | Fit | Speed | β |
|---|---|---|---|---|---|---|
Kimi K3 8B2026-07 Kimi K3 8B dense model. | 8B | Q4_K_M~4.55 GB file | 5.56 GB | 5.6 GB needed | β | |
Kimi K3 22B MoE2026-07 MoE architectureKimi K3 MoE architecture. | 22B | Q5_K_M~14.60 GB file | 17.02 GB | 17.0 GB needed | β | |
Qwen 3.6 35B-A3B MoE2026-04 MoE architectureRequested Qwen 3.6 35B MoE. | 35B | Q4_K_M~19.93 GB file | 22.74 GB | 22.7 GB needed | β | |
Qwen 3.6 27B2026-04 Qwen 3.6 27B dense model. | 27B | Q4_K_M~15.37 GB file | 17.73 GB | 17.7 GB needed | β | |
Google Gemma 3n E4B2025-06 Gemma 3n mobile-first, edge-optimized. | 4B | Q5_K_M~2.66 GB file | 3.07 GB | 3.1 GB needed | β | |
Meta Llama 4 Scout 17B2025-04 MoE architectureLlama 4 Scout MoE, 17B active params. | 17B | Q4_K_M~9.68 GB file | 11.47 GB | 11.5 GB needed | β | |
Qwen 3 8B2025-04 Qwen 3 8B with thinking mode. | 8B | Q4_K_M~4.55 GB file | 5.63 GB | 5.6 GB needed | β | |
Qwen 3 4B2025-04 Qwen 3 4B, compact reasoning model. | 4B | Q5_K_M~2.65 GB file | 3.54 GB | 3.5 GB needed | β | |
Qwen 3 1.7B2025-04 Qwen 3 tiny, great for edge devices. | 2B | Q5_K_M~1.13 GB file | 1.72 GB | 1.7 GB needed | β | |
Qwen 3 30B-A3B MoE2025-04 MoE architectureQwen 3 MoE, 3B active of 30B total. | 30B | Q4_K_M~17.08 GB file | 19.20 GB | 19.2 GB needed | β | |
Google Gemma 3 12B Instruct2025-03 Gemma 3 mid, vision + text. | 12B | Q4_K_M~6.83 GB file | 7.72 GB | 7.7 GB needed | β | |
Google Gemma 3 27B Instruct2025-03 Gemma 3 large, open 27B. | 27B | Q4_K_M~15.37 GB file | 17.18 GB | 17.2 GB needed | β | |
Google Gemma 3 4B Instruct2025-02 Multimodal-capable 4B. | 4B | Q5_K_M~2.65 GB file | 3.07 GB | 3.1 GB needed | β | |
Mistral Small 24B Instruct2025-01 Mistral Small 3 (24B). | 24B | Q4_K_M~13.66 GB file | 15.72 GB | 15.7 GB needed | β | |
DeepSeek R1 Distill 7B2025-01 R1 reasoning distilled into 7B. | 7B | Q4_K_M~3.99 GB file | 4.62 GB | 4.6 GB needed | β |
Showing 1 to 15 of 57 models