← AI Hashrate 中文

Qwen3.6-35B-A3B-FP8

Qwen · 36.0B (active NoneB) · MoE · ctx NoneK · apache-2.0 · HuggingFace

Qwen3.6-35B-A3B-FP8 (Qwen) is a 36.0B parameters MoE (36.0B active per token) open-weight model tracked on AI Hashrate. At 8K context we estimate roughly 28.0 GB VRAM for Q4 (weights 19.8 GB + KV 7.2 GB + 1 GB overhead) and 80.2 GB for FP16. About 24 GPUs/accelerators in our catalog fully fit this model at Q4 under that context assumption. Fastest Q4 configs: B200 192GB SXM ≈ 141.4 tok/s (estimated); MI300X 192GB ≈ 93.7 tok/s (estimated); H200 141GB SXM5 ≈ 84.8 tok/s (estimated); H100 80GB SXM5 ≈ 59.2 tok/s (estimated); Gaudi 3 128GB ≈ 57.9 tok/s (estimated). Use the table below for VRAM fit and tok/s per dollar (list MSRP). Estimates follow memory-bandwidth math; measured rows override when present. See methodology for details. Methodology.

92 hardware configs — sorted by tok/s. Default fit context 8K.

HardwareVRAMQuanttok/sFits?tok/s/$
B200 192GB SXM192Q4141.4 est.Yes0.004
MI300X 192GB192Q493.7 est.Yes0.006
H200 141GB SXM5141Q484.8 est.Yes0.002
H100 80GB SXM580Q459.2 est.Yes0.002
Gaudi 3 128GB128Q457.9 est.Yes0.005
H100 80GB SXM580FP1646.3 est.No0.002
B200 192GB SXM192FP1638.9 est.Yes0.001
RTX 4090 24GB24Q437.3 est.No0.023
RTX 4090D 24GB (China)24Q437.3 est.No0.023
RTX 3090 Ti 24GB24Q437.3 est.No0.019
A100 80GB SXM480Q436.0 est.Yes0.002
RX 7900 XTX 24GB24Q435.5 est.No0.036
RTX 3090 24GB24Q434.7 est.No0.023
RTX 5090 32GB32Q431.7 est.Yes0.016
A100 80GB SXM480FP1628.2 est.No0.002
MI300X 192GB192FP1625.8 est.Yes0.002
H200 141GB SXM5141FP1623.3 est.Yes0.001
RX 7900 XT 20GB20Q420.6 est.No0.023
RTX 6000 Ada 48GB48Q417.0 est.Yes0.003
V100 32GB SXM232Q415.9 est.Yes0.002
Gaudi 3 128GB128FP1615.9 est.Yes0.001
RTX 5080 16GB16Q415.8 est.No0.016
L40S 48GB48Q415.3 est.Yes0.002
V100 16GB PCIe16Q414.8 est.No0.002
RTX 5070 Ti 16GB16Q414.7 est.No0.02
Mac Studio M3 Ultra 96GB96Q414.5 est.Yes0.004
Mac Studio M2 Ultra 192GB192Q414.1 est.Yes0.002
RTX A6000 48GB48Q413.6 est.Yes0.003
RTX 4080 Super 16GB16Q412.1 est.No0.012
RTX 4070 Ti Super 16GB16Q411.0 est.No0.014
Arc Pro B70 32GB32Q410.7 est.Yes0.011
RX 9070 16GB16Q410.5 est.No0.019
RX 9070 XT 16GB16Q410.5 est.No0.018
RX 7800 XT 16GB16Q410.3 est.No0.021
MacBook Pro M4 Max 128GB128Q49.7 est.Yes0.002
RX 7900 GRE 16GB16Q49.5 est.No0.017
Arc A770 16GB16Q49.2 est.No0.026
DGX Spark (GH200 480GB)480Q48.8 est.Yes0.003
RTX 5060 Ti 16GB16Q47.4 est.No0.017
MacBook Pro M1 Max 32GB32Q47.1 est.Yes0.002
MacBook Pro M1 Max 64GB64Q47.1 est.Yes0.002
MacBook Pro M3 Max 128GB128Q47.1 est.Yes0.002
RTX 5070 12GB12Q46.2 est.No0.011
Titan V 12GB12Q46.0 est.No0.002
T4 16GB16Q45.3 est.No0.003
RTX 4070 Ti 12GB12Q45.1 est.No0.006
Titan Xp 12GB12Q45.1 est.No0.004
RTX 3080 10GB10Q44.9 est.No0.007
RTX 6000 Ada 48GB48FP164.8 est.No0.001
Mac mini M4 Pro 64GB64Q44.8 est.Yes0.002
RTX 4070 12GB12Q44.7 est.No0.008
RTX 4060 Ti 16GB16Q44.7 est.No0.009
RTX 4070 Super 12GB12Q44.7 est.No0.008
RX 7600 XT 16GB16Q44.7 est.No0.014
Titan X Pascal 12GB12Q44.4 est.No0.004
L40S 48GB48FP164.3 est.No0.001
Arc B580 12GB12Q44.2 est.No0.017
RTX 5090 32GB32FP164.0 est.No0.002
RX 7700 XT 12GB12Q44.0 est.No0.009
Mac Studio M3 Ultra 96GB96FP164.0 est.Yes0.001
Mac Studio M2 Ultra 192GB192FP163.9 est.Yes0.001
RTX A6000 48GB48FP163.8 est.No0.001
Ryzen AI Max+ 395 128GB96Q43.8 est.Yes0.002
Ryzen AI Max+ 395 64GB48Q43.8 est.Yes0.003
Ryzen AI Max 390 64GB48Q43.8 est.Yes0.003
MacBook Pro M1 Max 64GB64FP163.5 est.No0.001
RTX 3060 12GB12Q43.3 est.No0.01
MacBook Pro M4 Max 128GB128FP162.7 est.Yes0.001
DGX Spark (GH200 480GB)480FP162.4 est.Yes0.001
Arc B570 10GB10Q42.4 est.No0.011
Mac mini M4 Pro 64GB64FP162.4 est.No0.001
Mac mini M4 32GB32Q42.1 est.Yes0.002
V100 32GB SXM232FP162.0 est.No0.0
MacBook Pro M3 Max 128GB128FP161.9 est.Yes0.0
RTX 5060 8GB8Q41.8 est.No0.006
RTX 5060 Ti 8GB8Q41.8 est.No0.005
RTX 3070 8GB8Q41.8 est.No0.004
RTX 4090 24GB24FP161.3 est.No0.001
RTX 4090D 24GB (China)24FP161.3 est.No0.001
RTX 3090 Ti 24GB24FP161.3 est.No0.001
Arc Pro B70 32GB32FP161.3 est.No0.001
RTX 3090 24GB24FP161.2 est.No0.001
RX 7900 XTX 24GB24FP161.2 est.No0.001
RTX 4060 Ti 8GB8Q41.2 est.No0.003
RX 7600 8GB8Q41.2 est.No0.004
RTX 4060 8GB8Q41.1 est.No0.004
Ryzen AI Max+ 395 64GB48FP161.1 est.No0.001
Ryzen AI Max 390 64GB48FP161.1 est.No0.001
Ryzen AI Max+ 395 128GB96FP161.0 est.Yes0.001
MacBook Pro M1 Max 32GB32FP160.9 est.No0.0
Tesla P4 8GB8Q40.8 est.No0.01
Mac mini M4 32GB32FP160.3 est.No0.0

Fit checks

12 popular retail GPUs; every row in the table above also links its Fits? verdict to the full fit check.

Same family: Qwen

Qwen3 Qwen3-8B · Qwen3-14B
Qwen2.5 Qwen2.5-7B-Instruct · Qwen2.5-32B-Instruct · Qwen2.5-14B-Instruct · Qwen2.5-72B-Instruct
Qwen3.5 Qwen3.5-9B · Qwen3.5-35B-A3B · Qwen3.5-2B · Qwen3.5-27B · Qwen3.5-122B-A10B · Qwen3.5-397B-A17B
Qwen3.6 Qwen3.6-35B-A3B · Qwen3.6-27B
Qwen3 2507 Qwen3-4B-Instruct-2507 · Qwen3-30B-A3B-Instruct-2507 · Qwen3-4B-Thinking-2507 · Qwen3-235B-A22B-Instruct-2507
Qwen2.5 Coder Qwen2.5-Coder-32B-Instruct
Qwen3 Coder Qwen3-Coder-Next · Qwen3-Coder-480B-A35B-Instruct
Qwen3 Next Qwen3-Next-80B-A3B-Instruct

All Qwen models →