跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

G

Gary Pan

@Gary Pan
取消关注 关注
关于
帖子
2
主题
2
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • M5 Max Macbook Pro Hermes环境 硬件测试
    G Gary Pan

    首先感谢一直以来youtube频道和论坛对我的帮助,让我能逐渐学习AI和大模型相关的知识,终于能自己测试和实践AI agent 和大模型的应用。

    关于这次测试的环境和测试项目
    具体硬件配置:
    14-inch MacBook Pro (2026)
    Apple M5 Max
    CPU 18-core (6 super cores + 12 performance cores)
    GPU 40-core
    Neural Engine 16-core
    Unified memory 128 GB (LPDDR5X, 9600 MT/s, 153.6 GB/s bandwidth)
    Storage 2 TB SSD

    测试模型:
    unsloth/Qwen3.6-35B-A3B-UD-MLX-4bit
    mlx-community/Qwen3.6-27B-OptiQ-4bit
    mlx-community/DeepSeek-V4-Flash-2bit-DQ

    平台使用omlx,应该是mac上最好上手且速度不错的平台了。

    oMLX模型配置:
    128k 上下文
    Turbo Quant KV cache:8bit
    Thinking On
    其他默认或关闭

    测试目标:
    测试三个不同模型在相同m5 max上的具体速度,智力,和可用性。
    这里因为经验有限,没有用专业的测试软件,完全由我个人体验评估,希望体谅。

    测试方式:
    Hermes上配置好模型,跑一段computer use的任务,记录任务完成过程和结果,记录omlx上的平均值。

    直接上结果:
    unsloth/Qwen3.6-35B-A3B-UD-MLX-4bit

    PP:963.7tk/s
    TG:50.8tk/s

    个人评价:
    速度:极快(速度超过cloud模型)
    智力:中上
    agent 能力:可用
    综合评价:适合所有场景,无明显短板,更适合跟agent一起干活的场景。

    mlx-community/Qwen3.6-27B-OptiQ-4bit

    PP:254.4tk/s
    TG:17.1tk/s

    个人评价:
    速度:略慢
    智力:中上(强于35B A3B,不明显)
    agent 能力:可用
    综合评价:适合大多场景,更适合无人的自动化agent workflow场景。

    mlx-community/DeepSeek-V4-Flash-2bit-DQ

    PP:270tk/s
    TG:35tk/s

    个人评价:
    速度:中
    智力:差(应该是2bit量化降智严重)
    agent 能力:别想了
    综合评价:虽然测试上 deepseek v4 flash 2bit没有成功,但是值得关注的点是,假设 v4 flash 4bit 量化下其实速度上是跟千问27B差不多的,只是内存吃不下所有的expert同时加载。如果可以把大部分的expert留在SSD上只加载激活的expert的话,应该是可以跑出超越QWEN 3.6 27B的效果,希望后续可以继续测试。

    AI硬件 hermes mac

  • M5 Macbook Pro Max 硬件测试 求助
    G Gary Pan

    下单了一个多月的满配 M5 Macbook Pro Max 14英寸终于到货了。
    准备这两天测试一下本地LLM性能,希望论坛大佬们给一些建议。
    准备测一下omlx 和 LMstudio 两个平台下跑千问3.6 27B 和 35B A3B 的对比,同时测试一下跑deepseek v4 flash的可行性。具体怎么测和用那些软件可能需要大家帮助。

    具体硬件配置如下(配置是AI整理的,错了麻烦提醒我):
    14-inch MacBook Pro (2026)
    Apple M5 Max
    CPU 18-core (6 super cores + 12 performance cores)
    GPU 40-core
    Neural Engine 16-core
    Unified memory 128 GB (LPDDR5X, 9600 MT/s, 153.6 GB/s bandwidth)
    Storage 2 TB SSD

    希望各位在开始之前给一些有用的建议,本人是有一点IT背景的商科专业,不是专业程序员,目前希望做一套能完全本地运行的Agent系统给更多的人使用,希望大家支持,谢谢!

    AI硬件 mac
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组