Mac 跑主流本地開源模型對照:哪台跑得動、跑多快(2026 年 8 月)
Phi-4、Gemma 3、Qwen3、Llama 4、DeepSeek V4、Kimi K2——8 個主流開源模型 × Mac 各晶片,以推理角度算出「最低需要哪台 Mac + 多少記憶體 + 預估速度」。關鍵:MoE 模型讓 Mac 特別划算,但 1T 級旗艦即使 Q4 也超過 Mac 記憶體上限,本地跑不了。
| 模型 | 類型(總參/active) | Q4 大小 | 最低 Mac + 記憶體 | 預估速度(理論上限) |
|---|---|---|---|---|
| Phi-4 14B | dense 14B | 8.9 GB | M5 base 32GB | ~17 tok/s(實測約 10–14) |
| Gemma 3 27B | dense 27B | 16.5 GB | M5 Pro 64GB | ~19 tok/s(實測約 11–15) |
| Qwen3.6 27B | dense 27B | 16.8 GB(二手) | M5 Pro 64GB | ~18 tok/s(實測約 11–15) |
| Llama 4 Scout | MoE 109B / 17B active | ~63 GB(估) | M5 Max 128GB | ~65 tok/s(算 17B active;實測約 40–52) |
| Qwen3 235B-A22B | MoE 235B / 22B active | 142 GB(實測) | M5 Ultra 256GB | ~100 tok/s(算 22B active;實測約 60–80) |
| GLM-4.6 | MoE 355B / 32B active | ~200 GB(估) | M5 Ultra 256GB | ~67 tok/s(算 32B active;實測約 40–54) |
| Kimi K2 | MoE 1T / 32B active | ~570 GB(估) | ⚠ 超過 512GB 上限 | 本地跑不了(Q4 仍超標,需更低量化) |
| DeepSeek V4-Pro | MoE 1.6T / 49B active | ~800 GB(估) | ⚠ 超過 512GB 上限 | 本地跑不了(改用 V4-Flash 284B/13B 變體) |
方法與來源
**性質:這是工程估算,非實測 benchmark。** 兩組輸入為核實值:(1)模型參數量/量化大小取自各 HuggingFace model card(Qwen3-235B、Gemma 3、Phi-4 的 Q4 大小為 GGUF 實測;DeepSeek V4-Pro、Kimi K2、Llama 4 Scout、GLM-4.6 的 Q4 大小為估算,依動態量化法差異可達數十 GB);(2)Mac 各晶片記憶體上限與頻寬取自 Apple 官方(M5 153 / M5 Pro 307 / M5 Max 614 / M5 Ultra 1200 GB/s;M6 為新一代 base 170GB/s 但僅 Mac mini、記憶體上限 32GB)。**推算公式(可自行驗算)**:①可用記憶體 ≈ 統一記憶體 ×0.75;②模型佔用 ≈ Q4 檔案大小 + KV cache(context 大時另增);③**預估速度(tokens/秒)≈ 記憶體頻寬 ÷ active 參數的 Q4 大小** —— MoE 只算 active 參數(這是 Mac 跑 MoE 快的關鍵)。**⚠ 速度是理論上限:實際受 prompt 長度、KV cache、量化法、軟體(MLX/llama.cpp)影響,實測通常是估算的 6–8 折,長脈絡更低。** 授權注意:Kimi K2.7 與 GLM-4.6 的最新版授權/參數本表未逐字核到官方卡,以 base 版數字為準,正式引用前請開官方 repo 確認。訓練/微調不在本表範圍(Mac 只適合推理與輕量 QLoRA,認真訓練請用 NVIDIA GPU)。來源:Apple 規格 https://www.apple.com/mac-studio/specs/ ;Qwen3-235B https://huggingface.co/Qwen/Qwen3-235B-A22B-Instruct-2507 ;DeepSeek V4-Pro https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro ;Kimi K2 https://huggingface.co/moonshotai/Kimi-K2-Instruct 。
來源:https://www.apple.com/mac-studio/specs/
擷取日期:2026-08-26
常見問題
- 「Mac 跑主流本地開源模型對照:哪台跑得動、跑多快(2026 年 8 月)」涵蓋哪些對象?
- 本表涵蓋 Phi-4 14B、Gemma 3 27B、Qwen3.6 27B、Llama 4 Scout、Qwen3 235B-A22B、GLM-4.6、Kimi K2、DeepSeek V4-Pro,對照欄位包含:模型、類型(總參/active)、Q4 大小、最低 Mac + 記憶體、預估速度(理論上限)。
- 這張表的資料來源與方法為何?
- **性質:這是工程估算,非實測 benchmark。
- 資料最後更新於何時?
- 本表資料擷取/更新日為 2026-08-26。