探討 Mac Studio M4 Max 本地 AI 效能:解碼吞吐「」GB10 與 Strix Halo,但頻寬效益極限明顯
為何重要
對於本地 AI 沙盒開發者而言,M4 Max 提供了兼具高頻寬與統一記憶體的價效比選項,有效緩解了大模型推理的解碼瓶頸。此教測揭示單高頻寬未必保證線性效能提升,端視模型壓縮程度與運算複雜度,這是深度最佳化推理路徑的重要洞察。隨著 Apple 硬體庫存吃緊,開發者生態與供應鏈的穩定性將是未來影響 Apple 硬體重要性的關鍵變數。
本文比較了 Nvidia GB10(DGX Spark)、AMD Ryzen AI Max+ 395 (Strix Halo) 與蘋果 Apple Silicon Mac Studio,闡述記憶體頻寬對 LLM 解碼的關鍵影響。
- M4 Max 在特定模型(如 Qwen 3.6-35B-A3B)的 token 生成吞吐量上超越 GB10 與 Strix Halo。
- 雖然 M4 Max 的記憶體頻寬理論值達 546 GB/s (為 GB10 的兩倍),但實測 token 產生速度僅提升約 25%。
- M4 Max 建議售價約 3,699 美元,與價格高昂的 Strix Halo 相比具備成本優勢。