← AI Hashrate 中文

qwen35b-a3b-fable-sft-abliterated

hotdogs · 34.7B (active 3.0B) · MoE · ctx 32K · agpl-3.0 · HuggingFace

qwen35b-a3b-fable-sft-abliterated (hotdogs) is a 34.7B parameters MoE (3.0B active per token) open-weight model tracked on AI Hashrate. At 8K context we estimate roughly 20.69 GB VRAM for Q4 (weights 19.09 GB + KV 0.6 GB + 1 GB overhead) and 71.0 GB for FP16. About 28 GPUs/accelerators in our catalog fully fit this model at Q4 under that context assumption. Fastest Q4 configs: B200 192GB SXM ≈ 1697.0 tok/s (estimated); MI300X 192GB ≈ 1124.2 tok/s (estimated); H200 141GB SXM5 ≈ 1018.2 tok/s (estimated); H100 80GB SXM5 ≈ 710.6 tok/s (estimated); Gaudi 3 128GB ≈ 694.9 tok/s (estimated). Use the table below for VRAM fit and tok/s per dollar (list MSRP). Estimates follow memory-bandwidth math; measured rows override when present. See methodology for details. Methodology.

90 hardware configs — sorted by tok/s. Default fit context 8K.

HardwareVRAMQuanttok/sFits?tok/s/$
B200 192GB SXM192Q41697.0 est.Yes0.042
MI300X 192GB192Q41124.2 est.Yes0.075
H200 141GB SXM5141Q41018.2 est.Yes0.029
H100 80GB SXM580Q4710.6 est.Yes0.024
Gaudi 3 128GB128Q4694.9 est.Yes0.056
B200 192GB SXM192FP16466.7 est.Yes0.012
RX 7900 XT 20GB20Q4451.9 est.No0.503
A100 80GB SXM480Q4432.5 est.Yes0.029
RTX 5090 32GB32Q4380.1 est.Yes0.19
RTX 5080 16GB16Q4346.9 est.No0.347
RTX 5070 Ti 16GB16Q4323.7 est.No0.432
MI300X 192GB192FP16309.2 est.Yes0.021
H200 141GB SXM5141FP16280.0 est.Yes0.008
RTX 4080 Super 16GB16Q4265.9 est.No0.266
RTX 4070 Ti Super 16GB16Q4242.8 est.No0.304
RX 9070 16GB16Q4231.2 est.No0.421
RX 9070 XT 16GB16Q4231.2 est.No0.386
RX 7800 XT 16GB16Q4225.5 est.No0.452
RTX 4090 24GB24Q4213.8 est.Yes0.134
RTX 4090D 24GB (China)24Q4213.8 est.Yes0.134
RTX 3090 Ti 24GB24Q4213.8 est.Yes0.107
RX 7900 GRE 16GB16Q4208.1 est.No0.379
RX 7900 XTX 24GB24Q4203.6 est.Yes0.204
RTX 6000 Ada 48GB48Q4203.6 est.Yes0.03
Arc A770 16GB16Q4202.3 est.No0.58
RTX 3090 24GB24Q4198.5 est.Yes0.132
H100 80GB SXM580FP16195.4 est.Yes0.007
Gaudi 3 128GB128FP16191.1 est.Yes0.015
L40S 48GB48Q4183.3 est.Yes0.023
Mac Studio M3 Ultra 96GB96Q4173.7 est.Yes0.043
Mac Studio M2 Ultra 192GB192Q4169.7 est.Yes0.024
RTX A6000 48GB48Q4162.9 est.Yes0.036
RTX 5060 Ti 16GB16Q4161.9 est.No0.377
RTX 5070 12GB12Q4136.4 est.No0.248
Titan V 12GB12Q4132.5 est.No0.044
Arc Pro B70 32GB32Q4129.0 est.Yes0.129
A100 80GB SXM480FP16118.9 est.Yes0.008
MacBook Pro M4 Max 128GB128Q4115.8 est.Yes0.026
T4 16GB16Q4115.6 est.No0.058
RTX 4070 Ti 12GB12Q4112.5 est.No0.141
Titan Xp 12GB12Q4111.3 est.No0.093
RTX 3080 10GB10Q4107.1 est.No0.153
DGX Spark (GH200 480GB)480Q4106.1 est.Yes0.035
RTX 4060 Ti 16GB16Q4104.1 est.No0.209
RX 7600 XT 16GB16Q4104.1 est.No0.316
RTX 4070 12GB12Q4102.3 est.No0.171
RTX 4070 Super 12GB12Q4102.3 est.No0.171
Titan X Pascal 12GB12Q497.5 est.No0.081
Arc B580 12GB12Q492.6 est.No0.372
RX 7700 XT 12GB12Q487.7 est.No0.195
MacBook Pro M1 Max 32GB32Q484.8 est.Yes0.026
MacBook Pro M1 Max 64GB64Q484.8 est.Yes0.022
MacBook Pro M3 Max 128GB128Q484.8 est.Yes0.02
RTX 3060 12GB12Q473.1 est.No0.222
RTX 6000 Ada 48GB48FP1673.1 est.No0.011
L40S 48GB48FP1665.7 est.No0.008
RTX 5090 32GB32FP1660.6 est.No0.03
RTX A6000 48GB48FP1658.4 est.No0.013
Mac mini M4 Pro 64GB64Q457.9 est.Yes0.026
MacBook Pro M1 Max 64GB64FP1654.1 est.No0.014
Arc B570 10GB10Q453.5 est.No0.244
Mac Studio M3 Ultra 96GB96FP1647.8 est.Yes0.012
Mac Studio M2 Ultra 192GB192FP1646.7 est.Yes0.007
Ryzen AI Max+ 395 128GB96Q445.6 est.Yes0.023
Ryzen AI Max+ 395 64GB48Q445.6 est.Yes0.03
Ryzen AI Max 390 64GB48Q445.6 est.Yes0.035
RTX 5060 8GB8Q440.3 est.No0.135
RTX 5060 Ti 8GB8Q440.3 est.No0.106
RTX 3070 8GB8Q440.3 est.No0.081
Mac mini M4 Pro 64GB64FP1636.9 est.No0.017
MacBook Pro M4 Max 128GB128FP1631.8 est.Yes0.007
DGX Spark (GH200 480GB)480FP1629.2 est.Yes0.01
RTX 4060 Ti 8GB8Q425.9 est.No0.065
RX 7600 8GB8Q425.9 est.No0.096
Mac mini M4 32GB32Q425.5 est.Yes0.026
RTX 4060 8GB8Q424.5 est.No0.082
MacBook Pro M3 Max 128GB128FP1623.3 est.Yes0.006
Arc Pro B70 32GB32FP1620.6 est.No0.021
RTX 4090 24GB24FP1619.2 est.No0.012
RTX 4090D 24GB (China)24FP1619.2 est.No0.012
RTX 3090 Ti 24GB24FP1619.2 est.No0.01
RX 7900 XTX 24GB24FP1618.2 est.No0.018
RTX 3090 24GB24FP1617.8 est.No0.012
Tesla P4 8GB8Q417.3 est.No0.216
Ryzen AI Max+ 395 64GB48FP1616.4 est.No0.011
Ryzen AI Max 390 64GB48FP1616.4 est.No0.013
MacBook Pro M1 Max 32GB32FP1613.5 est.No0.004
Ryzen AI Max+ 395 128GB96FP1612.5 est.Yes0.006
RX 7900 XT 20GB20FP1610.6 est.No0.012
Mac mini M4 32GB32FP164.1 est.No0.004

Fit checks

12 popular retail GPUs; every row in the table above also links its Fits? verdict to the full fit check.