Nanbeige's compact LLM lab uses Looped Transformer architecture to maximize capacity per parameter. Nanbeige4.2-3B outperforms 9B+ models on agentic and reasoning benchmarks while fitting in under 2.5 GB at Q4.
| Model | Params (B) | Ctx (K) | Q4 (GB) | License | Fit check |
|---|---|---|---|---|---|
| Nanbeige4.2-3B | 4.0 | 128 | 2.2 | apache-2.0 | on Tesla P4 8GB |