ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

探討 Mac Studio M4 Max 本地 AI 效能:解碼吞吐「」GB10 與 Strix Halo,但頻寬效益極限明顯

硬體 1 個來源 · 6 天前
為何重要

對於本地 AI 沙盒開發者而言,M4 Max 提供了兼具高頻寬與統一記憶體的價效比選項,有效緩解了大模型推理的解碼瓶頸。此教測揭示單高頻寬未必保證線性效能提升,端視模型壓縮程度與運算複雜度,這是深度最佳化推理路徑的重要洞察。隨著 Apple 硬體庫存吃緊,開發者生態與供應鏈的穩定性將是未來影響 Apple 硬體重要性的關鍵變數。

本文比較了 Nvidia GB10(DGX Spark)、AMD Ryzen AI Max+ 395 (Strix Halo) 與蘋果 Apple Silicon Mac Studio,闡述記憶體頻寬對 LLM 解碼的關鍵影響。

  • M4 Max 在特定模型(如 Qwen 3.6-35B-A3B)的 token 生成吞吐量上超越 GB10 與 Strix Halo。
  • 雖然 M4 Max 的記憶體頻寬理論值達 546 GB/s (為 GB10 的兩倍),但實測 token 產生速度僅提升約 25%。
  • M4 Max 建議售價約 3,699 美元,與價格高昂的 Strix Halo 相比具備成本優勢。
Apple SiliconM4 MaxNvidia GB10AMD Ryzen AI Max+ 395LLM inference

來源 · 1 篇報導

首發 Tom's Hardware tomshardware.com 22:52