Alex Ziskind 把 M6 與 M4 Mac mini 並排,透過 llama.cpp 執行量化版 Qwen 3.5 9B。第一輪結果中,M6 處理提示詞為每秒 742 個 token(模型切分文字的單位),M4 為 210 個;生成文字則是 26.9 對 18 個。前者約為 3.5 倍,後者快約五成。

他接著直接讓兩台機器產生文字,畫面上 M6 明顯先寫滿一整個視窗;這輪數據較接近每秒 71 對 45.9 個 token 的提示詞處理速度,以及 26 對 17.4 個 token 的生成速度。兩次測試都指向同一件事:M6 不只讀提示詞更快,寫出回覆也更快。

不過這 80 秒沒有交代兩台 Mac mini 的記憶體容量是否相同、完整執行參數、測試次數與價格。留言區也有人追問是否為同級配置,以及舊款較低售價換算每個 token 的成本後會不會更划算。這組結果能證明影片裡的 M6 跑得更快,還不足以單獨回答已經有 M4 的人該不該升級。