@applejuice 我当时用的BY的冷头,但是3090是双面显存,需要用双面冷头,所以做不到标准的双槽厚度。操作倒是按部就班,小心谨慎就好。
-
求推荐5090水冷头 -
求推荐5090水冷头请教各位,我的5090 夜神在满载工作的时候风扇噪音还是觉得大,又想改水冷了。之前3090刚买回来就改了双面水冷感觉很舒服,5090的水冷头大家有什么推荐吗?谢谢。
-
Qwen3.8-27B-MLX-8bit on M5 max -
Qwen3.8-27B-MLX-8bit on M5 max开了MTP Q6可以跑到40-50tps,还是多模态无审查模型。纯文本Deepseek V4 flash也是可用的速度。
-
Qwen3.8-27B-MLX-8bit on M5 max
-
Qwen3.8-27B-MLX-8bit on M5 max
-
Qwen3.8-27B-MLX-8bit on M5 max
-
关于小公司跑本地大模型硬件建议@KAKAHermes 我投mac studio,我也是从3090、5090后来转向mac 平台,macos反而最简单,少很多对硬件兼容性、散热、稳定性、可维护的时间和人力成本。我在跑omlx我觉得很友好,稳定。年初从m5 max 128开机部署好omlx以后它就一直在角落跑,甚至不是高密度长时间运行都可以直接用显示器的typec线充电,噪音可忽略,耗能少,环境友好。虽然不知道将来是否需要继续扩充多台,但是目前看4台m3 ultra也能达到内存池扩展的效果,就像老特说的,32G5090跑comfy ui就不算瓶颈了,这样mac做llm server endpoint,mac mini、macbook pro跑agent,5090跑comfy ui,系统风险也有隔离,看起来也是一个完整的场景了。
-
Qwen3.8-27B-MLX-8bit on M5 max
-
Qwen3.8-27B-MLX-8bit on M5 max@YUN-WANG 同意,我现在m5 max gpu经常用不满,估计还是带宽更瓶颈一些吧。
-
Qwen3.8-27B-MLX-8bit on M5 max@williamlouis 我先订了m5 ultra,还是带宽更优先吧,看有传闻可能就重点在m7了。
-
Qwen3.8-27B-MLX-8bit on M5 max@Tony-Wang 速度很满意了,就是Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality这个模型去掉了图片、视频模块,也没有去审查,稍微遗憾了一点。
-
Qwen3.8-27B-MLX-8bit on M5 max@kos-or 试了chimingw/Qwen3.8-27B-Uncensored-OrcaRouter-MLX-4bit、pyros-vault/Qwen3.8-27B-Uncensored-oQ4e-mtp、KostkaIT/Qwen3.8-27B-Huihui-Abliterated-oQ6e-MTP-MLX都可以到30tps,可能是因为是全多模态吧。反而Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality这个混合8bit模型可以到40tps。
-
Qwen3.8-27B-MLX-8bit on M5 maxQ8,开了MTP,速度可以接受了
-
Qwen3.8-27B-MLX-8bit on M5 max
-
Qwen3.8-27B-MLX-8bit on M5 maxQwen3.8发布,先试了试在M5 Max上跑的速度,用的是lmstudio-community/Qwen3.8-27B-MLX-8bit,结果如下,供大家参考。

-
对 M5 MAX 跑本地大模型有点失望M5 Max 跑 Qwen 122b a10b Q4 的话, 如果内存够, 不大可能只有 20-25t/s.
我的M5 pro 跑 Qwen 27b 稠密加上MTP之后, 还能跑到20以上, 64k上下文时候掉到 17多.
按这个速度推理, M5 max 是我显存带宽的两倍, 它能到 40t/s 以上.
122b A10b 肯定比27b 稠密要快, 应该能跑到 60t/s以上, 我估计.
另外, 122A10 的智力应该不如 27b 稠密, 只是知识面更宽.
请教一下Tony的Qwen27B MTP用的哪个版本的模型?我下了oQ8-mtp,omlx经常退出,看日志好像是mtp的bug,求推荐稳定运行的模型版本,谢谢!
-
macbookpro M3max 128G 8T怎么折腾玩本地AI?
今天设置了一下Qwen3.6 27B Q8的MTP版本,速度从18左右上升到28,但是8并发速度提升没有太大影响。最终用的是Jundot/Qwen3.6-27B-oQ6-mtp,一开始尝试Youssofal/Qwen3.6-27B-MTPLX-Optimized-Speed结果报错,兼容还是没整好。 -
3080ti这速度不错啊是啊,我也在考虑要不要再买一张3090,看起来不用nvlink效果也不错,就是突然发现好像没有看到魔改3080 ti的。
-
3080ti这速度不错啊MTP就是载入慢点儿,速度看来快不少




