Your browser does not seem to support JavaScript. As a result, your viewing experience will be diminished, and you have been placed in read-only mode.
Please download a browser that supports JavaScript, or enable it if it's disabled (i.e. NoScript).
Q8,开了MTP,速度可以接受了
@zorg Q8 MTP能到这个速度,属于完全可用了
马上出 M6了。期待下吧。
Q4 4bit MTP 能達到 30 TPS 嗎?
那是M5 Pro强,还是M6强? 个人感觉应该M5 Pro更强点
@YUN-WANG 規格M5 Pro更强 M6是新一代2奈米晶片 但是核心數量是初階
@kos-or 试了chimingw/Qwen3.8-27B-Uncensored-OrcaRouter-MLX-4bit、pyros-vault/Qwen3.8-27B-Uncensored-oQ4e-mtp、KostkaIT/Qwen3.8-27B-Huihui-Abliterated-oQ6e-MTP-MLX都可以到30tps,可能是因为是全多模态吧。反而Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality这个混合8bit模型可以到40tps。
@Tony-Wang 速度很满意了,就是Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality这个模型去掉了图片、视频模块,也没有去审查,稍微遗憾了一点。
@williamlouis 我先订了m5 ultra,还是带宽更优先吧,看有传闻可能就重点在m7了。
@YUN-WANG 同意,我现在m5 max gpu经常用不满,估计还是带宽更瓶颈一些吧。
Qwen3.8发布,先试了试在M5 Max上跑的速度,用的是lmstudio-community/Qwen3.8-27B-MLX-8bit,结果如下,供大家参考。
开了MTP Q6可以跑到40-50tps,还是多模态无审查模型。纯文本Deepseek V4 flash也是可用的速度。
@zorg 那还挺好,长上下文如何,我看最高才32K,意义不大。max的算力还是不错啊,其实640G的带宽和R9700 Pro一样了。
@terry
@zorg 这个速度感觉真能用了。就是价格还是有点美丽
@zorg 还行,prefill如何,如果不慢这速度够用,加上苹果的安静,是有市场的。
@zorg said: 开了MTP Q6可以跑到40-50tps,还是多模态无审查模型。
@zorg said:
开了MTP Q6可以跑到40-50tps,还是多模态无审查模型。
如果是 MTP Q4 不就可以上50-60 tps, 但要看輸出品質的差異是否可用? Agent 可能差異不大 但coding或許有差異
沒研究過Apples , 放在供大家 參考一下價格
Apple "MacBook Pro" M5 Max 基本款 約14萬台幣 , 18C CPU/32C GPU , 36 GB Unified Memory,
Apple "MacBook Pro" M5 Max 頂規 約24萬台幣 , 18C CPU/40C GPU , 128 GB Unified Memory,
你好!看起来您对这段对话很感兴趣,但您还没有一个账号。
厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。
有了你的建议,这篇帖子会更精彩哦 💗