Every local LLM ranked by the r/LocalLLaMA community. 5 S-tier, 17 A-tier, updated continuously. 方法论.
| Tier | Model | Params | Q4 VRAM | Context | Vendor | Best for |
|---|---|---|---|---|---|---|
| S | gemma-4-26B-A4B-it MoE general multilingual creative | 25.2B | 13.9 GB | 256k | General assistant · Translation / multilingual | |
| S | Qwen3.6-35B-A3B MoE general coding multilingual | 36.0B | 19.8 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| S | Qwen3.5-35B-A3B MoE general coding multilingual | 34.7B | 19.1 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| S | Qwen3.6-27B general coding multilingual reasoning | 27.8B | 15.3 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| S | DeepSeek-V4-Flash MoE general coding reasoning multilingual | 158.1B | 87.0 GB | 1000k | DeepSeek | General assistant · Code gen / PR review |
| A | Qwen3-8B general coding multilingual | 8.2B | 4.5 GB | 128k | Alibaba | General assistant · Code gen / PR review |
| A | Qwen3.5-9B general coding multilingual | 8.95B | 4.9 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| A | Qwen3.5-27B general coding multilingual | 27.0B | 14.8 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| A | gemma-4-12b-it general multilingual creative | 11.95B | 6.6 GB | 256k | General assistant · Translation / multilingual | |
| A | Kimi-K2.6 MoE general coding reasoning multilingual | 1030.0B | 566.5 GB | 256k | Moonshot | General assistant · Code gen / PR review |
| A | gemma-4-31B-it general multilingual creative | 30.7B | 16.9 GB | 256k | General assistant · Translation / multilingual | |
| A | Kimi-K2.7-Code MoE coding reasoning | 1030.0B | 566.5 GB | 256k | Moonshot | Code gen / PR review · Complex reasoning |
| A | MiMo-V2.5 MoE general multilingual coding | 310.0B | 170.5 GB | 1024k | Xiaomi | General assistant · Translation / multilingual |
| A | Qwen3.5-122B-A10B MoE general coding multilingual | 122.0B | 67.1 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| A | DeepSeek-V4-Pro MoE general coding reasoning multilingual | 861.6B | 473.9 GB | 1000k | DeepSeek | General assistant · Code gen / PR review |
| A | Qwen2.5-Coder-32B-Instruct coding reasoning | 32.8B | 18.0 GB | 32k | Alibaba | Code gen / PR review · Complex reasoning |
| A | Qwen3-Coder-Next MoE coding reasoning | 79.7B | 43.8 GB | 256k | Alibaba | Code gen / PR review · Complex reasoning |
| A | Ornith-1.0-9B general creative roleplay | 9.0B | 5.0 GB | 256k | DeepReinforce | General assistant · Creative writing |
| A | Ornith-1.0-35B MoE general creative roleplay | 35.0B | 19.2 GB | 256k | DeepReinforce | General assistant · Creative writing |
| A | Qwen3-Next-80B-A3B-Instruct MoE general coding reasoning | 81.3B | 44.7 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| A | Qwen3-235B-A22B-Instruct-2507 MoE general coding reasoning multilingual | 235.1B | 129.3 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| A | Qwen3-Coder-480B-A35B-Instruct MoE coding reasoning | 480.2B | 264.1 GB | 256k | Alibaba | Code gen / PR review · Complex reasoning |
| B | Qwen2.5-7B-Instruct general multilingual | 7.6B | 4.2 GB | 128k | Alibaba | General assistant · Translation / multilingual |
| B | Llama-3.1-8B-Instruct general creative | 8.0B | 4.4 GB | 128k | Meta | General assistant · Creative writing |
| B | gpt-oss-20b MoE general creative | 21.5B | 11.8 GB | 128k | OpenAI | General assistant · Creative writing |
| B | gemma-4-E2B-it general multilingual | 5.1B | 2.8 GB | 128k | General assistant · Translation / multilingual | |
| B | Mistral-7B-Instruct-v0.3 general multilingual | 7.2B | 4.0 GB | 32k | Mistral | General assistant · Translation / multilingual |
| B | Qwen3.5-2B general multilingual | 2.0B | 1.1 GB | 256k | Alibaba | General assistant · Translation / multilingual |
| B | gemma-4-E4B-it general multilingual | 8.0B | 4.4 GB | 128k | General assistant · Translation / multilingual | |
| B | Qwen3-14B general multilingual | 14.8B | 8.1 GB | 128k | Alibaba | General assistant · Translation / multilingual |
| B | Qwen3-4B-Instruct-2507 general multilingual | 4.0B | 2.2 GB | 256k | Alibaba | General assistant · Translation / multilingual |
| B | gpt-oss-120b MoE general creative | 120.4B | 66.2 GB | 128k | OpenAI | General assistant · Creative writing |
| B | Llama-4-Scout-17B-16E-Instruct MoE general creative | 109.0B | 60.0 GB | 10240k | Meta | General assistant · Creative writing |
| B | MiniMax-M3 MoE general multilingual | 428.0B | 235.4 GB | 1024k | MiniMax | General assistant · Translation / multilingual |
| B | Qwen2.5-32B-Instruct general coding multilingual | 32.8B | 18.0 GB | 128k | Alibaba | General assistant · Code gen / PR review |
| B | Qwen2.5-14B-Instruct general multilingual | 14.8B | 8.1 GB | 128k | Alibaba | General assistant · Translation / multilingual |
| B | GLM-4.7-Flash MoE general multilingual | 31.2B | 17.2 GB | 198k | Z.ai | General assistant · Translation / multilingual |
| B | Llama-3.2-3B-Instruct general creative | 3.2B | 1.8 GB | 128k | Meta | General assistant · Creative writing |
| B | DeepSeek-R1-0528-Qwen3-8B reasoning | 8.2B | 4.5 GB | 128k | DeepSeek | Complex reasoning |
| B | Mistral-Small-4-119B-2603 MoE general multilingual | 119.0B | 65.5 GB | 256k | Mistral | General assistant · Translation / multilingual |
| B | NVIDIA-Nemotron-3-Nano-4B-BF16 general multilingual | 4.0B | 2.2 GB | 256k | NVIDIA | General assistant · Translation / multilingual |
| B | Step-3.5-Flash MoE general multilingual | 196.8B | 108.2 GB | 256k | StepFun | General assistant · Translation / multilingual |
| B | Qwen3-30B-A3B-Instruct-2507 MoE general coding multilingual | 30.5B | 16.8 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| B | MiniCPM5-1B general multilingual | 1.08B | 0.6 GB | 128k | OpenBMB | General assistant · Translation / multilingual |
| B | Hy3 MoE general multilingual | 295.0B | 162.2 GB | 256k | Tencent | General assistant · Translation / multilingual |
| B | Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16 MoE reasoning general | 30.0B | 16.5 GB | 256k | NVIDIA | Complex reasoning · General assistant |
| B | MiniMax-M2.7 MoE general multilingual | 228.7B | 125.8 GB | 200k | MiniMax | General assistant · Translation / multilingual |
| B | Mistral-Medium-3.5-128B general multilingual | 128.0B | 70.4 GB | 256k | Mistral | General assistant · Translation / multilingual |
| B | DeepSeek-R1-Distill-Qwen-32B reasoning | 32.8B | 18.0 GB | 128k | DeepSeek | Complex reasoning |
| B | NVIDIA-Nemotron-3-Super-120B-A12B-BF16 MoE general multilingual | 120.0B | 66.0 GB | 256k | NVIDIA | General assistant · Translation / multilingual |
| B | Devstral-Small-2-24B-Instruct-2512 general coding | 24.0B | 13.2 GB | 256k | Mistral | General assistant · Code gen / PR review |
| B | Inkling MoE general creative roleplay | 975.0B | 536.2 GB | 1024k | Thinking Machines | General assistant · Creative writing |
| B | GLM-5.2 MoE general multilingual coding | 753.3B | 414.3 GB | 1000k | Z.ai | General assistant · Translation / multilingual |
| B | GLM-4.5-Air MoE general multilingual | 110.5B | 60.8 GB | 128k | Z.ai | General assistant · Translation / multilingual |
| B | Qwen3.5-397B-A17B MoE general coding multilingual | 397.0B | 218.3 GB | 256k | Alibaba | General assistant · Code gen / PR review |
| B | DeepSeek-R1-Distill-Qwen-14B reasoning | 14.8B | 8.1 GB | 128k | DeepSeek | Complex reasoning |
| B | Qwen3-4B-Thinking-2507 reasoning | 4.0B | 2.2 GB | 256k | Alibaba | Complex reasoning |
| B | qwen35b-a3b-fable-sft-abliterated MoE general roleplay | 34.7B | ? | 32k | hotdogs | General assistant · Roleplay / chat |
| B | Qwen3.5-122B-A10B-Heretic-v2-MLX-mixed-3.8bit MoE general | 19.8B | ? | Nonek | TheCluster | General assistant |
| C | DeepSeek-R1 MoE reasoning | 684.5B | 376.5 GB | 128k | DeepSeek | Complex reasoning |
| C | Llama-3.1-70B-Instruct general creative | 70.6B | 38.8 GB | 128k | Meta | General assistant · Creative writing |
| C | gemma-3-27b-it general multilingual | 27.4B | ? | Nonek | General assistant · Translation / multilingual | |
| C | Llama-3.3-70B-Instruct general creative | 70.6B | 38.8 GB | 128k | Meta | General assistant · Creative writing |
| C | Qwen2.5-72B-Instruct general multilingual | 72.7B | 40.0 GB | 128k | Alibaba | General assistant · Translation / multilingual |
| C | NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4 MoE general | 550.0B | 302.5 GB | 256k | NVIDIA | General assistant |
| C | GLM-5.1 MoE general multilingual | 753.9B | 414.6 GB | 198k | Z.ai | General assistant · Translation / multilingual |
| C | OLMo-2-1124-13B-Instruct general | 13.7B | ? | Nonek | allenai | General assistant |
| C | AI21-Jamba-Large-1.5 general | 398.6B | ? | Nonek | ai21labs | General assistant |
| Qwen3.6-35B-A3B-NVFP4 MoE | 21.6B | ? | Nonek | nvidia | — | |
| Qwen3.6-35B-A3B-FP8 MoE | 36.0B | ? | Nonek | Qwen | — | |
| gemma-4-31B-it-FP8-block | 31.3B | ? | Nonek | RedHatAI | — | |
| gemma-4-26B-A4B-it-AWQ-4bit | 26.6B | ? | Nonek | cyankiwi | — | |
| DeepSeek-R1-0528-Qwen3-8B-layer-mix-bpw-3.8-mlx | 2.3B | ? | Nonek | GreenBitAI | — |