← AI Hashrate EN

OLMo-2-1124-13B-Instruct

allenai · 13.7B · ctx NoneK · apache-2.0 · HuggingFace

OLMo-2-1124-13B-Instruct(allenai)是 AI Hashrate 收录的13.7B 参数开放权重模型。 按 8K 上下文估算:Q4 约需 11.28 GB VRAM(权重 7.54 GB + KV 2.74 GB + 开销 1 GB),FP16 约需 31.14 GB。 在该上下文假设下,目录中约有 52 款 GPU/加速器能在 Q4 下完整装下此模型。 Q4 最快配置:B200 192GB SXM ≈ 371.6 tok/s(估算); MI300X 192GB ≈ 246.2 tok/s(估算); H200 141GB SXM5 ≈ 223.0 tok/s(估算); H100 80GB SXM5 ≈ 155.6 tok/s(估算); Gaudi 3 128GB ≈ 152.2 tok/s(估算)。 下表给出各硬件的 VRAM 装机情况与每美元 tok/s(按 MSRP 标价)。估算基于显存带宽公式;有实测时以实测为准。详见方法论页。 方法论.

122 个硬件配置——按 tok/s 排序。默认装机上下文 8K。

硬件VRAM量化tok/s装得下?tok/s/$
B200 192GB SXM192Q4371.6 估算0.009
MI300X 192GB192Q4246.2 估算0.016
H200 141GB SXM5141Q4223.0 估算0.006
H100 80GB SXM580Q4155.6 估算0.005
Gaudi 3 128GB128Q4152.2 估算0.012
B200 192GB SXM192FP16102.2 估算0.003
A100 80GB SXM480Q494.7 估算0.006
RTX 5090 32GB32Q483.2 估算0.042
RTX 3080 10GB10Q478.9 估算0.113
MI300X 192GB192FP1667.7 估算0.005
H200 141GB SXM5141FP1661.3 估算0.002
RTX 4090 24GB24Q446.8 估算0.029
RTX 4090D 24GB (China)24Q446.8 估算0.029
RTX 3090 Ti 24GB24Q446.8 估算0.023
RTX 5080 16GB16Q444.6 估算0.045
RX 7900 XTX 24GB24Q444.6 估算0.045
RTX 6000 Ada 48GB48Q444.6 估算0.007
RTX 3090 24GB24Q443.5 估算0.029
H100 80GB SXM580FP1642.8 估算0.001
Gaudi 3 128GB128FP1641.8 估算0.003
RTX 5070 Ti 16GB16Q441.6 估算0.056
L40S 48GB48Q440.1 估算0.005
Arc B570 10GB10Q439.4 估算0.18
Mac Studio M3 Ultra 96GB96Q438.0 估算0.01
Mac Studio M2 Ultra 192GB192Q437.2 估算0.005
RX 7900 XT 20GB20Q437.2 估算0.041
RTX A6000 48GB48Q435.7 估算0.008
RTX 4080 Super 16GB16Q434.2 估算0.034
RTX 4070 Ti Super 16GB16Q431.2 估算0.039
RTX 5070 12GB12Q431.2 估算0.057
Titan V 12GB12Q430.3 估算0.01
RTX 5060 8GB8Q429.7 估算0.099
RTX 5060 Ti 8GB8Q429.7 估算0.078
RTX 3070 8GB8Q429.7 估算0.06
RX 9070 16GB16Q429.7 估算0.054
RX 9070 XT 16GB16Q429.7 估算0.05
RX 7800 XT 16GB16Q429.0 估算0.058
Arc Pro B70 32GB32Q428.2 估算0.028
RX 7900 GRE 16GB16Q426.8 估算0.049
A100 80GB SXM480FP1626.0 估算0.002
Arc A770 16GB16Q426.0 估算0.074
RTX 4070 Ti 12GB12Q425.7 估算0.032
Titan Xp 12GB12Q425.5 估算0.021
MacBook Pro M4 Max 128GB128Q425.4 估算0.006
RTX 4070 12GB12Q423.4 估算0.039
RTX 4070 Super 12GB12Q423.4 估算0.039
DGX Spark (GH200 480GB)480Q423.2 估算0.008
RTX 5090 32GB32FP1622.9 估算0.011
Titan X Pascal 12GB12Q422.3 估算0.019
RTX 4090 24GB24FP1621.8 估算0.014
RTX 4090D 24GB (China)24FP1621.8 估算0.014
RTX 3090 Ti 24GB24FP1621.8 估算0.011
Arc B580 12GB12Q421.2 估算0.085
RX 7900 XTX 24GB24FP1620.8 估算0.021
RTX 5060 Ti 16GB16Q420.8 估算0.048
RTX 3090 24GB24FP1620.2 估算0.013
RX 7700 XT 12GB12Q420.1 估算0.045
RTX 4060 Ti 8GB8Q419.1 估算0.048
RX 7600 8GB8Q419.1 估算0.071
MacBook Pro M1 Max 32GB32Q418.6 估算0.006
MacBook Pro M1 Max 64GB64Q418.6 估算0.005
MacBook Pro M3 Max 128GB128Q418.6 估算0.004
RTX 4060 8GB8Q418.0 估算0.06
RTX 3060 12GB12Q416.7 估算0.051
T4 16GB16Q414.9 估算0.007
RTX 4060 Ti 16GB16Q413.4 估算0.027
RX 7600 XT 16GB16Q413.4 估算0.041
Tesla P4 8GB8Q412.7 估算0.159
Mac mini M4 Pro 64GB64Q412.7 估算0.006
RTX 6000 Ada 48GB48FP1612.3 估算0.002
RX 7900 XT 20GB20FP1612.0 估算0.013
L40S 48GB48FP1611.0 估算0.001
Mac Studio M3 Ultra 96GB96FP1610.5 估算0.003
Mac Studio M2 Ultra 192GB192FP1610.2 估算0.001
Ryzen AI Max+ 395 128GB96Q410.0 估算0.005
Ryzen AI Max+ 395 64GB48Q410.0 估算0.007
Ryzen AI Max 390 64GB48Q410.0 估算0.008
RTX A6000 48GB48FP169.8 估算0.002
RTX 5080 16GB16FP169.2 估算0.009
RTX 5070 Ti 16GB16FP168.6 估算0.011
Arc Pro B70 32GB32FP167.8 估算0.008
RTX 4080 Super 16GB16FP167.1 估算0.007
MacBook Pro M4 Max 128GB128FP167.0 估算0.002
RTX 4070 Ti Super 16GB16FP166.5 估算0.008
DGX Spark (GH200 480GB)480FP166.4 估算0.002
RX 9070 16GB16FP166.1 估算0.011
RX 9070 XT 16GB16FP166.1 估算0.01
RX 7800 XT 16GB16FP166.0 估算0.012
Mac mini M4 32GB32Q45.6 估算0.006
RX 7900 GRE 16GB16FP165.5 估算0.01
Arc A770 16GB16FP165.4 估算0.015
MacBook Pro M1 Max 32GB32FP165.1 估算0.002
MacBook Pro M1 Max 64GB64FP165.1 估算0.001
MacBook Pro M3 Max 128GB128FP165.1 估算0.001
RTX 5060 Ti 16GB16FP164.3 估算0.01
RTX 5070 12GB12FP163.6 估算0.007
Titan V 12GB12FP163.5 估算0.001
Mac mini M4 Pro 64GB64FP163.5 估算0.002
T4 16GB16FP163.1 估算0.002
RTX 4070 Ti 12GB12FP163.0 估算0.004
Titan Xp 12GB12FP163.0 估算0.003
RTX 3080 10GB10FP162.8 估算0.004
RTX 4060 Ti 16GB16FP162.8 估算0.006
RX 7600 XT 16GB16FP162.8 估算0.009
RTX 4070 12GB12FP162.7 估算0.005
RTX 4070 Super 12GB12FP162.7 估算0.005
Ryzen AI Max+ 395 128GB96FP162.7 估算0.001
Ryzen AI Max+ 395 64GB48FP162.7 估算0.002
Ryzen AI Max 390 64GB48FP162.7 估算0.002
Titan X Pascal 12GB12FP162.6 估算0.002
Arc B580 12GB12FP162.5 估算0.01
RX 7700 XT 12GB12FP162.3 估算0.005
RTX 3060 12GB12FP161.9 估算0.006
Mac mini M4 32GB32FP161.5 估算0.002
Arc B570 10GB10FP161.4 估算0.006
RTX 5060 8GB8FP161.1 估算0.004
RTX 5060 Ti 8GB8FP161.1 估算0.003
RTX 3070 8GB8FP161.1 估算0.002
RTX 4060 8GB8FP160.7 估算0.002
RTX 4060 Ti 8GB8FP160.7 估算0.002
RX 7600 8GB8FP160.7 估算0.003
Tesla P4 8GB8FP160.5 估算0.006

装机核对

12 款热门零售 GPU;上表每行的「装得下?」结论同样链接到完整装机核对页。