← AI Hashrate EN

AI21-Jamba-Large-1.5

ai21labs · 398.6B · ctx NoneK · other · HuggingFace

AI21-Jamba-Large-1.5(ai21labs)是 AI Hashrate 收录的398.6B 参数开放权重模型。 按 8K 上下文估算:Q4 约需 299.95 GB VRAM(权重 219.23 GB + KV 79.72 GB + 开销 1 GB),FP16 约需 877.92 GB。 在该上下文假设下,目录中约有 1 款 GPU/加速器能在 Q4 下完整装下此模型。 Q4 最快配置:DGX Spark (GH200 480GB) ≈ 0.8 tok/s(估算)。 下表给出各硬件的 VRAM 装机情况与每美元 tok/s(按 MSRP 标价)。估算基于显存带宽公式;有实测时以实测为准。详见方法论页。 方法论.

13 个硬件配置——按 tok/s 排序。默认装机上下文 8K。

硬件VRAM量化tok/s装得下?tok/s/$
B200 192GB SXM192Q414.9 估算0.0
MI300X 192GB192Q49.9 估算0.001
H200 141GB SXM5141Q44.8 估算0.0
Gaudi 3 128GB128Q42.7 估算0.0
Mac Studio M2 Ultra 192GB192Q41.5 估算0.0
H100 80GB SXM580Q41.1 估算0.0
DGX Spark (GH200 480GB)480Q40.8 估算0.0
A100 80GB SXM480Q40.7 估算0.0
MacBook Pro M4 Max 128GB128Q40.5 估算0.0
Mac Studio M3 Ultra 96GB96Q40.4 估算0.0
MacBook Pro M3 Max 128GB128Q40.3 估算0.0
DGX Spark (GH200 480GB)480FP160.2 估算0.0
Ryzen AI Max+ 395 128GB96Q40.1 估算0.0

装机核对

12 款热门零售 GPU;上表每行的「装得下?」结论同样链接到完整装机核对页。