快訊
2026-07-10

Mac 跑本地 LLM 記憶體怎麼挑?Apple Silicon 統一記憶體與 M4/M5 選購全解析

封面示意圖:Apple Silicon 晶片與統一記憶體概念,深綠底搭配晶片圖騰,標題為 Mac 本地 LLM 記憶體選購

想在 Mac 上跑本地 LLM,買機器前最該搞懂的不是 GPU 核心數,而是統一記憶體。本文從 Apple Silicon 的統一記憶體架構講起,拆解「容量決定塞得下、頻寬決定跑得快」的關鍵差異,完整對照 M4、M5、M5 Pro 與 M5 Max 的記憶體上限與頻寬,再附上 8B 到 70B 各級模型的記憶體需求對照與選購建議,幫你一次買對不後悔。

為什麼本地 LLM 跑不快?真瓶頸是記憶體頻寬,不是顯卡算力

記憶體頻寬與本地 LLM token 速度關係示意封面,含晶片與頻寬階梯圖示

在本地端跑 LLM,決定生成速度的常常不是顯示卡算力,而是記憶體頻寬。本文從自迴歸解碼機制講起,說明 token 速度為何約等於「頻寬 ÷ 模型大小」,並用 RTX 5090、Apple M5、Strix Halo 等官方頻寬數據對照,拆解模型溢出系統 RAM 的「頻寬懸崖」與統一記憶體「塞得下不等於跑得快」的取捨。