跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
Z

zorg

@zorg
德高望重
取消关注 关注
关于
帖子
43
主题
4
分享
0
群组
1
粉丝
1
关注
0

帖子

最新 最佳 有争议的

  • 求推荐5090水冷头
    Z zorg

    @applejuice 我当时用的BY的冷头,但是3090是双面显存,需要用双面冷头,所以做不到标准的双槽厚度。操作倒是按部就班,小心谨慎就好。

    AI硬件 rtx5090

  • 求推荐5090水冷头
    Z zorg

    请教各位,我的5090 夜神在满载工作的时候风扇噪音还是觉得大,又想改水冷了。之前3090刚买回来就改了双面水冷感觉很舒服,5090的水冷头大家有什么推荐吗?谢谢。

    AI硬件 rtx5090

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    @terry
    截屏2026-08-31 下午1.14.29.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    开了MTP Q6可以跑到40-50tps,还是多模态无审查模型。纯文本Deepseek V4 flash也是可用的速度。

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    DEEPSEEKV4Flash0731.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    截屏2026-08-31 上午4.21.21.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    截屏2026-08-31 上午3.36.50.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • 关于小公司跑本地大模型硬件建议
    Z zorg

    @KAKAHermes 我投mac studio,我也是从3090、5090后来转向mac 平台,macos反而最简单,少很多对硬件兼容性、散热、稳定性、可维护的时间和人力成本。我在跑omlx我觉得很友好,稳定。年初从m5 max 128开机部署好omlx以后它就一直在角落跑,甚至不是高密度长时间运行都可以直接用显示器的typec线充电,噪音可忽略,耗能少,环境友好。虽然不知道将来是否需要继续扩充多台,但是目前看4台m3 ultra也能达到内存池扩展的效果,就像老特说的,32G5090跑comfy ui就不算瓶颈了,这样mac做llm server endpoint,mac mini、macbook pro跑agent,5090跑comfy ui,系统风险也有隔离,看起来也是一个完整的场景了。

    AI硬件 本地模型 rtxpro6000 服务器

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    截屏2026-08-31 上午12.11.46.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    @YUN-WANG 同意,我现在m5 max gpu经常用不满,估计还是带宽更瓶颈一些吧。

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    @williamlouis 我先订了m5 ultra,还是带宽更优先吧,看有传闻可能就重点在m7了。

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    @Tony-Wang 速度很满意了,就是Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality这个模型去掉了图片、视频模块,也没有去审查,稍微遗憾了一点。

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    @kos-or 试了chimingw/Qwen3.8-27B-Uncensored-OrcaRouter-MLX-4bit、pyros-vault/Qwen3.8-27B-Uncensored-oQ4e-mtp、KostkaIT/Qwen3.8-27B-Huihui-Abliterated-oQ6e-MTP-MLX都可以到30tps,可能是因为是全多模态吧。反而Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality这个混合8bit模型可以到40tps。

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    Q8,开了MTP,速度可以接受了

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    截屏2026-08-26 上午3.27.51.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • Qwen3.8-27B-MLX-8bit on M5 max
    Z zorg

    Qwen3.8发布,先试了试在M5 Max上跑的速度,用的是lmstudio-community/Qwen3.8-27B-MLX-8bit,结果如下,供大家参考。
    截屏2026-08-15 上午12.29.38.png

    LLM讨论区 qwen-27b mac 量化 apple-m5

  • 对 M5 MAX 跑本地大模型有点失望
    Z zorg

    @Tony-Wang 说:

    @johnnybegood

    M5 Max 跑 Qwen 122b a10b Q4 的话, 如果内存够, 不大可能只有 20-25t/s.

    我的M5 pro 跑 Qwen 27b 稠密加上MTP之后, 还能跑到20以上, 64k上下文时候掉到 17多.

    按这个速度推理, M5 max 是我显存带宽的两倍, 它能到 40t/s 以上.

    122b A10b 肯定比27b 稠密要快, 应该能跑到 60t/s以上, 我估计.

    另外, 122A10 的智力应该不如 27b 稠密, 只是知识面更宽.

    请教一下Tony的Qwen27B MTP用的哪个版本的模型?我下了oQ8-mtp,omlx经常退出,看日志好像是mtp的bug,求推荐稳定运行的模型版本,谢谢!

    AI硬件 mac 本地模型 apple-m5

  • macbookpro M3max 128G 8T怎么折腾玩本地AI?
    Z zorg

    截屏2026-05-27 15.27.32.png
    今天设置了一下Qwen3.6 27B Q8的MTP版本,速度从18左右上升到28,但是8并发速度提升没有太大影响。最终用的是Jundot/Qwen3.6-27B-oQ6-mtp,一开始尝试Youssofal/Qwen3.6-27B-MTPLX-Optimized-Speed结果报错,兼容还是没整好。

    AI硬件 mac apple-m3

  • 3080ti这速度不错啊
    Z zorg

    是啊,我也在考虑要不要再买一张3090,看起来不用nvlink效果也不错,就是突然发现好像没有看到魔改3080 ti的。

    AI硬件 nvidia rtx3080ti 多卡部署

  • 3080ti这速度不错啊
    Z zorg

    MTP就是载入慢点儿,速度看来快不少
    HIdu3VmWwAAs-oS.jpg
    HIdn9CkWoAAlcUV.jpg
    HIdoVv5WwAAQ1MU.jpg
    HIdpeKeWMAA2gvi.jpg

    AI硬件 nvidia rtx3080ti 多卡部署
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组