M5pro 64G LLM性能参考.
-
Mac 适合 用 在线算力。做一个 API集合路由 狂剽 免费API。生产力肯定不行。办公室 缩减开资是可以实现的。chat生态推荐。
-
@Vittoria-Veloso 用肯定是能勉强用, 但是prefill太慢, 以及10几个token的decode, 感受很差.
@Tony-Wang 你用omlx真的,专门针对mac优化了。lmstudio还有ollama确实不大行。
-
@82445418 根本不可能
-
@Tony-Wang 可以,5090, pro 5000, 6000都行。
-
我靠, 我觉得还是可以抢救一下的, 刚才又在oMLX 加上了SpecPrefill , 加了一个qwen3.5 2B Q4 用来预测, PP狂涨.
这个对我做LLM wiki 还是很有价值的.

-
@Tony-Wang 那抢救一下,发点数据来,这就很有意义了。
-
感謝大大無私的分享!
我有在猶豫要不要等 MacStudio M5Ultra,不過就現在看起來 CP 值可能不太高
我有看國外 YT 跑 Qwen-3.6-27B 4bit 在 MBP M5Max 128GB 上,TG 大概就是 23 t/s, PP 忘記多少,就最近觀看的數據相比於 7900XTX, 距離是被甩開的,就再等看看 MacStudio M5Ultra 出來的表現囉~
總之,謝謝大大分享,給我們這實用的數據



不改变mac跑AI废物的局面,这是硬件残疾,很难后天修复。