蘋果發表新一代 Mac Studio:M5 Max 與 M5 Ultra 同場亮相

蘋果在 8 月下旬無預警更新桌上型產品線。官方新聞室公告確認新款 Mac Studio 搭載 M5 Max 與全新 M5 Ultra 兩種晶片,AI 效能最高提升 4.3 倍,圖形處理速度也再度提升。台灣官網產品頁同步上線,以「極致的專業級桌上型電腦」定位這台機器,並強調更快速的記憶體與儲存裝置,以及「空前的 AI 實力」。

同一天,TechNews 的報導指出 Mac mini 也首度搭載 M6 與 M5 Pro 晶片亮相,蘋果等於一次把多條晶片產品線推進到新世代。在蘋果的產品敘事裡,Mac mini 照顧主流使用者,Mac Studio 則「鎖定專業創作者與 AI 開發者」——這個分工點出此次更新的真正主角:能塞進大量統一記憶體、讓大型模型留在本機推論的桌機工作站。

M5 Ultra 規格重點:36 核心 CPU、80 核心 GPU、最高 512GB 統一記憶體

規格面,M5 Ultra 版 Mac Studio 在 Apple 台灣線上商店的選購頁提供 36 核心 CPU 搭配 80 核心 GPU 的配置,統一記憶體最高可選到 512GB;從 256GB 升級到 512GB,選購頁顯示需要再加新台幣 140,000 元。M5 Max 版的 Mac Studio 則負責相對親民的價格帶,台灣售價 84,900 元起,是進入這條產品線的門檻選項。

值得注意的是官方的敘事順序:公告把 AI 效能的「巨大飛躍」放在這次更新的第一位,圖形處理速度的提升反而排在後面。對照過去 Mac Studio 以剪輯、3D 渲染為主要賣點的溝通方式,這一代的定位已經明確往前挪到模型推論——蘋果預設買這台機器的人,第一件事是在桌上跑大型語言模型,其次才是創作工作流。

為什麼統一記憶體是本機跑 LLM 的關鍵

要理解 512GB 為什麼重要,得回到蘋果晶片的基本架構。傳統 PC 把系統記憶體與顯示卡記憶體分成兩池,模型權重得先進系統記憶體、再搬進 VRAM;蘋果的統一記憶體架構讓 CPU 與 GPU 共用同一池高速記憶體,權重載入一次就能被 GPU 直接讀取,省去來回搬移的延遲與頻寬浪費。對推論工作負載來說,「模型放不放得進記憶體」決定能不能跑,「記憶體頻寬多高」決定跑多快。

容量可以做個粗略估算:模型權重以 FP16 儲存時,每個參數約占 2 bytes,一個 70B 參數的模型完整載入約需 140GB;換成 4-bit 量化,空間可壓到約 35GB。往上看,512GB 的統一記憶體在 4-bit 量化下,理論上足以容納一千億參數級、甚至逼近兆級參數模型的量化版本——這樣的容量幾年前只有伺服器級 GPU 叢集做得到,如今裝進一台安靜的桌機。

實務上,本機推論很少以全精度權重執行:開源生態的主流做法是 4-bit 或 8-bit 量化,以可接受的品質損失換取數倍的容量餘裕。512GB 的價值因此在於選擇空間——開發者可以載入更大的量化模型,也能為長上下文推論保留足夠的 KV 快取,不必在模型規模與上下文長度之間二選一。

統一記憶體架構:CPU 與 GPU 共用同一池記憶體,模型權重載入一次就能被 GPU 直接讀取
圖1 Mac Studio 的 CPU 與 GPU 共用同一池統一記憶體,大型模型的權重載入一次即可使用,這是把大模型留在本機推論的關鍵條件。

512GB 並非首創:M3 Ultra 世代早有先例

把時間軸拉長,512GB 這個數字並不是 M5 Ultra 的創舉。一篇 2026 年發表在 arXiv 的論文在實驗設定中明載其硬體為「Apple M3 Ultra with 512 GB unified memory」,並註記 Ultra 系列的 Mac Studio 可選配至 512GB 統一記憶體。換句話說,上一個 Ultra 世代的工作站,就已經把記憶體天花板推到這裡。

這也讓 M5 Ultra 的差異化落在別處:新世代 CPU 與 GPU 帶來的 AI 運算吞吐(官方稱最高提升 4.3 倍),以及更快的記憶體與儲存速度。對已持有 M3 Ultra 512GB 機種的使用者來說,升級誘因是速度而非容量;對還在觀望的人,這一代的意義是「容量天花板不變、運算能力大幅補上」,兩者合起來才構成完整的大型模型工作站。

台灣售價與購買決策:84,900 元起,512GB 要再加 14 萬

台灣售價部分,Yahoo奇摩新聞彙整的購買指南報導:搭載 M5 Max 的 Mac Studio 售價 NT$84,900 起、教育優惠價 NT$78,090 起;搭載 M5 Ultra 的版本售價 NT$199,900 起、教育優惠價 NT$185,390 起。

若目標是本機跑大模型,記憶體升級費用得算進總帳:從 256GB 統一記憶體升級到 512GB 需再加 NT$140,000,也就是說,一台 512GB「完整體」的 M5 Ultra,總價至少逼近 34 萬元,且還不含從基本容量升到 256GB 的價差。對照雲端 API 的按量計費,這是典型的一次性資本支出抉擇:本機推論沒有每 token 成本、資料不出機器,但初期投入高,尖峰吞吐也有限。預算有限的開發者,可以先從 M5 Max 版起步,把模型規模限制在量化後的中小型模型。

Mac Studio 記憶體與售價階梯,M5 Ultra 版 199,900 元起、512GB 升級再加 140,000 元
圖2 M5 Ultra 版 Mac Studio 台灣售價 199,900 元起,自 256GB 統一記憶體升級到 512GB 需再加 140,000 元,完整體總價逼近 34 萬元。

對開發者與企業的實際影響

對開發者,這代硬體把「桌機原型開發」的可行範圍往上推了一階:過去必須租雲端 GPU 才能載入的模型,現在可以常駐本機,迭代速度不再受排隊與冷啟動影響。對隱私敏感的企業場景——醫療資料、法律文件、客戶程式碼——本機推論代表資料主權:機密內容不必送到第三方 API,就能完成摘要、檢索與分析。

生態系是另一半真相。Apple Silicon 上的推論主要走 Apple 自家的 MLX 與 Metal 路線,前述在 M3 Ultra 上進行 GPU 原生運算的研究,便是以 MLX 生態的工具執行;從 CUDA 生態移植的工程成本仍然存在。這讓採購決策不只是規格比較,而是工作流程的選擇:已採用開源權重模型的團隊受惠最大,例如 Muse Glimmer 這類主打本機常駐代理的 30B 模型;深度依賴特定雲端服務的團隊則未必划算——要把模型放在自己桌上,還是繼續放在別人的機房,兩條路的成本結構已經明顯分歧。

官方數字之外:採購前該留意的限制

官方溝通中有幾件事仍待驗證。第一,「AI 效能最高提升 4.3 倍」是行銷口徑,公告未明確定義比較基準與測試條件,實際增益取決於模型大小、量化方式與框架,獨立評測出爐前宜保守解讀。第二,記憶體頻寬等關鍵規格在官方頁面上尚未完整揭露,而頻寬恰恰決定推論速度,直接影響「跑得動」與「跑得快」的差距。第三,開賣時程與供貨狀況以 Apple 台灣官網為準,首波缺貨在歷代 Ultra 機種上並不罕見。

值得追蹤的後續指標有三:針對 M5 Ultra 的大型模型推論獨立評測、MLX 生態對新晶片的支援時程,以及雲端 API 價格的變動——最後一項決定本機推論的成本優勢有多大。硬體條件已經到位,接下來的問題是軟體生態與實測數字,能不能撐起「工作站級本機推論」這個定位。