RTX 3090 24GB 的显存带宽高约 134%(936 对 400 GB/s)。batch-1 解码与带宽强相关,因此同能装下的模型在 RTX 3090 24GB 上解码约快 134%。 Q4/8K 下 MacBook Pro M1 Max 32GB 能装下的目录模型更多——69 个模型中 39 对 35(32 对 24 GB VRAM)。 能装进 MacBook Pro M1 Max 32GB 却装不进 RTX 3090 24GB 的最大模型:Qwen2.5-32B-Instruct(32.8B)。 MSRP:MacBook Pro M1 Max 32GB 为 $3,299,RTX 3090 24GB 为 $1,499。MSRP 是发布标价而非实时售价——Amazon 价格会波动,点进去才是在售价格。 下方 Q4/8K 正面对比(51 个共有模型)中,RTX 3090 24GB 在 51 行 tok/s 更高,0 行落后。 方法论.
| MacBook Pro M1 Max 32GB | RTX 3090 24GB | |
|---|---|---|
| 厂商 | Apple | NVIDIA |
| VRAM | 32 GB | 24 GB |
| 显存类型 | LPDDR5 | GDDR6X |
| 显存带宽 | 400 GB/s | 936 GB/s |
| TDP | 120 W | 350 W |
| MSRP(标价) | $3,299 | $1,499 |
| 购买 | 搜索 Amazon (返利链接) | MSI GeForce RTX 3090 Ventus 3X 24G OC (返利链接) · 更多商品 |
| 模型 | 参数 (B) | MacBook Pro M1 Max 32GB tok/s | MacBook Pro M1 Max 32GB 装得下 | RTX 3090 24GB tok/s | RTX 3090 24GB 装得下 | 胜者 |
|---|---|---|---|---|---|---|
| MiniCPM5-1B | 1.08 | 235.7 估算 | 是 | 551.5 估算 | 是 | RTX 3090 24GB |
| Qwen3.5-2B | 2.0 | 127.3 估算 | 是 | 297.8 估算 | 是 | RTX 3090 24GB |
| DeepSeek-R1-0528-Qwen3-8B-layer-mix-bpw-3.8-mlx | 2.3 | 110.7 估算 | 是 | 259.0 估算 | 是 | RTX 3090 24GB |
| Qwen3.6-35B-A3B | 36.0 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| Qwen3.5-35B-A3B | 34.7 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| GLM-4.7-Flash | 31.2 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| Qwen3-30B-A3B-Instruct-2507 | 30.5 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16 | 30.0 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| Ornith-1.0-35B | 35.0 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| qwen35b-a3b-fable-sft-abliterated | 34.7 | 84.8 估算 | 是 | 198.5 估算 | 是 | RTX 3090 24GB |
| Llama-3.2-3B-Instruct | 3.2 | 79.5 估算 | 是 | 186.1 估算 | 是 | RTX 3090 24GB |
| gpt-oss-20b | 21.5 | 70.7 估算 | 是 | 161.8 实测 | 是 | RTX 3090 24GB |
| Qwen3-Coder-Next | 79.7 | 122.9 估算 | 否 | 161.7 估算 | 否 | RTX 3090 24GB |
| gemma-4-26B-A4B-it | 25.2 | 67.0 估算 | 是 | 156.7 估算 | 是 | RTX 3090 24GB |
| Qwen3-Next-80B-A3B-Instruct | 81.3 | 118.2 估算 | 否 | 155.5 估算 | 否 | RTX 3090 24GB |
| MacBook Pro M1 Max 32GB | RTX 3090 24GB | |
|---|---|---|
| 装得下的目录模型 | 69 个中 39 个 | 69 个中 35 个 |
| 独占装下的最大模型 | Qwen2.5-32B-Instruct (32.8B) | — |