← AI Hashrate EN

gemma-3-27b-it

Google · 27.4B · ctx 128K · gemma · HuggingFace

gemma-3-27b-it(Google)是 AI Hashrate 收录的27.4B 参数开放权重模型。 按 8K 上下文估算:Q4 约需 21.82 GB VRAM(权重 15.34 GB + KV 5.48 GB + 开销 1 GB),FP16 约需 61.28 GB。 在该上下文假设下,目录中约有 29 款 GPU/加速器能在 Q4 下完整装下此模型。 Q4 最快配置:B200 192GB SXM ≈ 311.2 tok/s(估算); MI300X 192GB ≈ 195.0 tok/s(估算); H200 141GB SXM5 ≈ 186.7 tok/s(估算); H100 80GB SXM5 ≈ 130.3 tok/s(估算); Gaudi 3 128GB ≈ 120.5 tok/s(估算)。 下表给出各硬件的 VRAM 装机情况与每美元 tok/s(按 MSRP 标价)。估算基于显存带宽公式;有实测时以实测为准。详见方法论页。 方法论.

107 个硬件配置——按 tok/s 排序。默认装机上下文 8K。

硬件VRAM量化tok/s装得下?tok/s/$
B200 192GB SXM192Q4311.2 估算0.008
MI300X 192GB192Q4195.0 估算0.013
H200 141GB SXM5141Q4186.7 估算0.005
H100 80GB SXM580Q4130.3 估算0.004
Gaudi 3 128GB128Q4120.5 估算0.01
B200 192GB SXM192FP1687.1 估算0.002
A100 80GB SXM480Q479.3 估算0.005
RTX 5090 32GB32Q469.7 估算0.035
MI300X 192GB192FP1654.6 估算0.004
H200 141GB SXM5141FP1652.3 估算0.001
RX 7900 XT 20GB20Q443.7 估算0.049
RTX 4090 24GB24Q438.8 估算临界0.024
RTX 4090D 24GB (China)24Q438.8 估算临界0.024
RTX 3090 Ti 24GB24Q438.8 估算临界0.019
RTX 6000 Ada 48GB48Q437.0 估算0.005
H100 80GB SXM580FP1636.5 估算0.001
RTX 3090 24GB24Q436.1 估算临界0.024
V100 32GB SXM232Q434.7 估算0.003
Gaudi 3 128GB128FP1633.8 估算0.003
RTX 5080 16GB16Q433.5 估算0.034
L40S 48GB48Q433.3 估算0.004
V100 16GB PCIe16Q431.4 估算0.004
RTX 5070 Ti 16GB16Q431.3 估算0.042
RTX A6000 48GB48Q429.2 估算0.006
MacBook Pro M4 Max 128GB128Q427.6 估算0.006
RX 7900 XTX 24GB24Q425.8 估算临界0.026
RTX 4080 Super 16GB16Q425.7 估算0.026
RTX 4070 Ti Super 16GB16Q423.5 估算0.029
RX 9070 16GB16Q422.4 估算0.041
RX 9070 XT 16GB16Q422.4 估算0.037
Arc Pro B70 32GB32Q422.4 估算0.022
A100 80GB SXM480FP1622.2 估算0.001
RX 7800 XT 16GB16Q421.8 估算0.044
MacBook Pro M1 Max 32GB32Q420.2 估算0.006
MacBook Pro M1 Max 64GB64Q420.2 估算0.005
MacBook Pro M3 Max 128GB128Q420.2 估算0.005
RX 7900 GRE 16GB16Q420.1 估算0.037
DGX Spark (GH200 480GB)480Q419.0 估算0.006
Arc A770 16GB16Q418.7 估算0.054
Mac Studio M3 Ultra 96GB96Q416.5 估算0.004
Mac Studio M2 Ultra 192GB192Q416.2 估算0.002
RTX 5060 Ti 16GB16Q415.6 估算0.036
RTX 5070 12GB12Q413.2 估算0.024
Titan V 12GB12Q412.8 估算0.004
Mac mini M4 Pro 64GB64Q412.5 估算0.006
T4 16GB16Q411.2 估算0.006
RTX 4070 Ti 12GB12Q410.9 估算0.014
Titan Xp 12GB12Q410.8 估算0.009
RTX 6000 Ada 48GB48FP1610.7 估算0.002
RTX 3080 10GB10Q410.4 估算0.015
RTX 4060 Ti 16GB16Q410.1 估算0.02
RX 7600 XT 16GB16Q410.1 估算0.031
RTX 4070 12GB12Q49.9 估算0.017
RTX 4070 Super 12GB12Q49.9 估算0.017
L40S 48GB48FP169.7 估算0.001
Titan X Pascal 12GB12Q49.4 估算0.008
RTX 5090 32GB32FP168.9 估算0.004
RTX A6000 48GB48FP168.6 估算0.002
Arc B580 12GB12Q48.6 估算0.035
RX 7700 XT 12GB12Q48.5 估算0.019
Ryzen AI Max+ 395 128GB96Q47.9 估算0.004
Ryzen AI Max+ 395 64GB48Q47.9 估算0.005
Ryzen AI Max 390 64GB48Q47.9 估算0.006
MacBook Pro M4 Max 128GB128FP167.7 估算0.002
RTX 3060 12GB12Q47.1 估算0.022
MacBook Pro M3 Max 128GB128FP165.7 估算0.001
Mac mini M4 32GB32Q45.5 估算临界0.006
DGX Spark (GH200 480GB)480FP165.3 估算0.002
Arc B570 10GB10Q44.9 估算0.022
Mac Studio M3 Ultra 96GB96FP164.6 估算0.001
V100 32GB SXM232FP164.5 估算0.0
MacBook Pro M1 Max 64GB64FP164.5 估算0.001
Mac Studio M2 Ultra 192GB192FP164.5 估算0.001
RTX 5060 8GB8Q43.9 估算0.013
RTX 5060 Ti 8GB8Q43.9 估算0.01
RTX 3070 8GB8Q43.9 估算0.008
Arc Pro B70 32GB32FP163.0 估算0.003
RTX 4090 24GB24FP162.8 估算0.002
RTX 4090D 24GB (China)24FP162.8 估算0.002
RTX 3090 Ti 24GB24FP162.8 估算0.001
RX 7900 XTX 24GB24FP162.7 估算0.003
Mac mini M4 Pro 64GB64FP162.7 估算0.001
RTX 3090 24GB24FP162.6 估算0.002
RTX 4060 Ti 8GB8Q42.5 估算0.006
RX 7600 8GB8Q42.5 估算0.009
RTX 4060 8GB8Q42.4 估算0.008
Ryzen AI Max+ 395 128GB96FP162.2 估算0.001
Tesla P4 8GB8Q41.7 估算0.021
RX 7900 XT 20GB20FP161.6 估算0.002
Ryzen AI Max+ 395 64GB48FP161.4 估算0.001
Ryzen AI Max 390 64GB48FP161.4 估算0.001
RTX 5080 16GB16FP161.2 估算0.001
V100 16GB PCIe16FP161.1 估算0.0
RTX 5070 Ti 16GB16FP161.1 估算0.001
MacBook Pro M1 Max 32GB32FP161.1 估算0.0
RTX 4080 Super 16GB16FP160.9 估算0.001
RTX 4070 Ti Super 16GB16FP160.8 估算0.001
RX 7800 XT 16GB16FP160.8 估算0.002
RX 9070 16GB16FP160.8 估算0.001
RX 9070 XT 16GB16FP160.8 估算0.001
RX 7900 GRE 16GB16FP160.7 估算0.001
Arc A770 16GB16FP160.7 估算0.002
RTX 5060 Ti 16GB16FP160.6 估算0.001
T4 16GB16FP160.4 估算0.0
RTX 4060 Ti 16GB16FP160.4 估算0.001
RX 7600 XT 16GB16FP160.4 估算0.001
Mac mini M4 32GB32FP160.3 估算0.0

装机核对

12 款热门零售 GPU;上表每行的「装得下?」结论同样链接到完整装机核对页。

同族模型:Gemma

Gemma 4 gemma-4-26B-A4B-it · gemma-4-E2B-it · gemma-4-E4B-it · gemma-4-12b-it · gemma-4-31B-it

全部 Gemma 模型 →