M6首發2奈米,M5 Ultra桌機塞512GB記憶體

蘋果發表了M6與M5 Ultra兩顆晶片,官方標題直接寫著“performance and AI compute”。M6進駐Mac mini,M5 Ultra進駐Mac Studio,現已開放預購,9月22日開始交貨。

M6是蘋果第一顆2奈米晶片,也是台積電2奈米製程首批量產產品之一。規格為12核心CPU(2顆超核心、4顆效能核心、6顆效率核心)、12核心GPU、雙16核心神經網路引擎,最高32GB統一記憶體、170GB/s頻寬。蘋果表示它擁有全球最快的單執行緒效能,多執行緒效能比M5快1.2倍,GPU的AI運算能力較M5提升約30%、較M1提升8倍以上,神經網路引擎效能是前一代的2倍。

M5 Ultra走的是堆料路線:用新一代UltraFusion把兩顆雙晶片的M5 Max串接起來,四晶片架構在M系列上是第一次。

M6M5 Ultra
CPU12核心最高36核心
GPU12核心最高80核心
神經網路引擎雙16核心32核心
統一記憶體最高32GB最高512GB
記憶體頻寬170GB/s1.2TB/s

M5 Ultra的GPU這次帶上了Neural Accelerators,AI運算能力較M3 Ultra提升4.5倍、較M1 Ultra提升6倍以上;1.2TB/s的頻寬比M3 Ultra高50%。蘋果的原話是“M5 Ultra features a massive GPU, now with Neural Accelerators, and more unified memory bandwidth, pushing the boundaries of what a desktop can do”。

512GB這條線能裝下什麼

統一記憶體的意義在本機推論場景裡最直觀:CPU和GPU共用一塊記憶體,模型權重不必在顯示記憶體和主記憶體之間來回搬動。對獨立顯卡方案來說,顯示記憶體多少就是硬上限;對Mac Studio來說,上限現在是512GB。

粗略算一筆。開源那批六、七千億參數的MoE模型,四位元量化後的權重體積大致落在350GB到400GB這一檔,再算上KV快取和執行時的額外開銷,512GB這個容量剛好能把它們整台裝下來。同規格的資料中心方案要湊出這個記憶體容量,得靠多卡互連,成本和供電完全是另一個量級。

頻寬仍是短板。1.2TB/s放在桌機上是很高的數字,擺到資料中心的HBM方案面前還是差一截,長上下文推論時吐字速度會明顯受限。它換來的是另一種價值:一台插牆上插座的機器,跑本機模型,資料不用外流。

2奈米這一步

M6拿到2奈米首發,節奏上蘋果依然站在最前面。製程紅利體現在能效比而非峰值頻率——12核心裡塞了6顆效率核心,加上170GB/s的頻寬(只比M5高10%),M6的設計取向是把功耗壓住,AI算力的增量主要來自GPU和神經網路引擎的重新設計。

放在同一週的產業背景裡看,方向是重疊的。資料中心那頭在拚每千瓦能跑多少推論,桌機這頭在拚一台機器能裝下多大的模型。推論成本正同時從兩端被往下壓,只是壓法不同。

至於Mac mini上的M6配32GB記憶體上限,本機能跑動的模型規模有限,這顆晶片的目標客群顯然不在這條線上。

參考來源:Apple Newsroom官方公告、MacRumors、CocoLoop、Phoronix、9to5Mac;核心數、記憶體容量頻寬與倍數口徑以官方公告核對,量化模型體積為依公開參數粗算。