跳转至内容
  • 混搭 DGX Spark GB10 Prefill + Mac Studio Decode

    固定直到 2026/9/12 02:18 AI硬件 dgxspark gb10 mac
    8
    3 赞同
    8 帖子
    132 浏览
    kos orK
    @terry said: 问题是跑ComfyUI怎么办? 我猜跑ComfyUI 機主可能用隔壁的Pro6000 四卡機
  • 离线 AI 开发笔记本求推荐:5090 24G 还是 M5 Pro 64G?

    AI硬件 rtx5090 mac apple-m5
    9
    0 赞同
    9 帖子
    184 浏览
    DI AlenD
    谢谢佬们建议,主要考虑笔记本携带方便,随时可以起服务,出差到客户,网络隔离也能使用。
  • M5 Ultra的1.2T/s高带宽有多大用处?

    LLM讨论区 mac apple-m5
    9
    0 赞同
    9 帖子
    357 浏览
    rock shiR
    @张光璞 我2080峰值到过7000哈哈哈
  • 0 赞同
    14 帖子
    540 浏览
    terryT
    @Fang-Liu 不是,我弟,你是否吹牛逼我们不在意,我们想要的就是你多发点帖子,总结下,这个回复也有价值,但是不如你单独发点测试帖子更好。论坛好要的内容,才有流量,然后才能赚钱。
  • MAC Studio M5 Ultra 被延期发货了

    AI硬件 mac apple-m5 apple-m6
    16
    0 赞同
    16 帖子
    387 浏览
    williamlouisW
    1万买不到32G 的 M6 .你都有 M4 24G了。搞一台 32G 的M6 提升不大。我刚把自己的M4 32G 发走给京东的爱回收。M6 32G 目前还没有好的购买渠道 需要等等。我买到跑一跑。应该和我预测的差不太多。32G这个内存数依旧是尴尬的。
  • 2 赞同
    49 帖子
    1k 浏览
    terryT
    @vosrock 我们这些屌丝,不要妄加揣测有钱人的生活,明星为什么买巴黎世家的塑料袋呢?
  • 请教:AMD R9700 还是 Mac Studio?

    LLM讨论区 r9700 mac apple-m5
    16
    0 赞同
    16 帖子
    447 浏览
    williamlouisW
    我有一块 京东自营 R9700 上个月 入手的 1.09W 原价处理有需要可以传送。三年个人送保或京东售后 都可以。瀚铠
  • Qwen3.8-27B-MLX-8bit on M5 max

    LLM讨论区 qwen-27b mac 量化 apple-m5
    25
    5 赞同
    25 帖子
    772 浏览
    kos orK
    沒研究過Apples , 放在供大家 參考一下價格 Apple "MacBook Pro" M5 Max 基本款 約14萬台幣 , 18C CPU/32C GPU , 36 GB Unified Memory, [image: ab801f4d-cccf-408e-a68d-4600ed9eeba0.jpeg] Apple "MacBook Pro" M5 Max 頂規 約24萬台幣 , 18C CPU/40C GPU , 128 GB Unified Memory, [image: b48b4c66-1dcf-4cb1-acad-6a87a53048a6.jpeg]
  • 跑小模型硬件咨询,谢谢

    AI硬件 mac qwen-27b 量化
    12
    0 赞同
    12 帖子
    278 浏览
    Tony WangT
    @YUN-WANG 说: 那如果用M5 MAX 36GB,会不会好很多? M5MAX 跑27B的话, 速度可能能到30以上, 基本可用了. 但是36GB不够用, 上下文会很短. 尤其你用AI-Agent的工具的时候.
  • Qwen3.8-Flash-Next M5 Max实测

    LLM讨论区 qwen mac apple-m5
    9
    3 赞同
    9 帖子
    481 浏览
    terryT
    @johnnybegood 你想多了,3090还是更能打。
  • 1 赞同
    7 帖子
    611 浏览
    Kirin H.K
    希望苹果能给AN两家点动力让他们认真的搞下小主机,不是现在这样的糊弄
  • 苹果发布了mac mini m6了,回头会做测评吗?

    AI硬件 mac
    8
    0 赞同
    8 帖子
    247 浏览
    张光璞
    @Tony-Wang 说: M6 内存带宽170G, 最高配32G内存. 这个定位是视频剪辑和日常工作用机. 想用LLM至少得M5 max 或者ultra. 170G 还不如 ai max 395
  • 0 赞同
    7 帖子
    1k 浏览
    williamlouisW
    @terry 机器太老了。CPU4核8线程。内存只有可怜的32G。Vulkan 跑不了。报错我没细看。让hesmes 自由发挥了。2个小时后 Rocm 版出炉了。没详细测。有空查查日志看看发生了什么。我猜是硬件不支持的面最大。 显卡点亮就折腾了好久。AMD 的生态 十分尿性。
  • 0 赞同
    11 帖子
    312 浏览
    Bin MaoB
    @stxpnet 说: 我的建议是,让AI上谷姐和REDDIT去帮你找 大本营,总有大神会和你用同款机器,然后他会精调一个专门针对这个机型的框架和模型,然后你接个deepseek v4,设计 好提示词,让梁文峰直接帮你抄作业就完事了。 我等了几天已经等到了。 以下给你一个HERMES可用的提示词: 去谷歌和reddit 帮我调研一下,最近7天内的,关于qwen 3.8 27b的模型比如(huggingface.co/zhnagchenchne/Qwen3.8-27B-GPTQ-W4A16 ),看看有哪些比较适合MacBook pro M5 MAX 128G 的,列最适合的10个,并用表格说明各自优劣势 ,我目前用的这个是 huggingface.co/twolven/Qwen3.8-27B-abliterated-AWQ-MTP ,感觉还行,但是离完美还有一些距离. 我比较喜欢【什么样的模型,用途主要是XXXX 】的。 如果reddit上找不到相关内容的话,可以从 huggingface.co/models?p=1&sort=created&search=qwen+3.8+27b 这个作为起点进去找找。 本会话可能要做为每日常规任务。主要目标是发掘一个适合 我本地 MacBook pro M5 MAX 128G 硬件的vllm或者sglang模型及框架 . 非常感谢,这个也很有帮助。。。马上办!
  • Qwen3.8 27B M5 Max

    LLM讨论区 qwen-27b mac apple-m5
    4
    1 赞同
    4 帖子
    286 浏览
    Tony WangT
    我找了一下, 我是 5月19日测试的, Qwen 3.6 27B oQ4. 今天oMLX发布了 0.3.9rc1, 支持了 native MTP, 我又测了一下加上了MTP机制的 27b oQ4, decode 明显提升, PP 基本不变. [image: 0948842d-9a88-4bc5-a041-2c523b7b2960.png]
  • M5 Max Macbook Pro Hermes环境 硬件测试

    AI硬件 hermes mac apple-m5
    6
    1 赞同
    6 帖子
    352 浏览
    C
    @Gary-Pan 说: 153.6 GB/s bandwidth M5 Max 官网写的是 614GB/s 内存带宽,这个 153.6 GB/s 指的是什么呢?
  • 2 赞同
    16 帖子
    722 浏览
    J
    @williamlouis 同意,做控制可用,也有些鸡肋,35B还不是很可靠,27B好一些,很慢。
  • 对 M5 MAX 跑本地大模型有点失望

    AI硬件 mac 本地模型 apple-m5
    56
    0 赞同
    56 帖子
    2k 浏览
    XiaoteX
    @jlist 给 Hermes Agent 配 RAG,按投入产出比分三档说: 一档:零基建(建议先这么用) Hermes 自带文件读写(read_file / search_files)和联网搜索,把研究资料整理成 markdown/PDF 放一个目录,会话里直接让它读+检索,几千篇以内完全够用。再加上它的 session_search(对过往对话做全文检索)和 skills(把常用流程固化成技能),很多"RAG 需求"其实不用搭任何东西。缺点是只有关键词/全文检索,没有向量语义检索。 二档:MCP 原生接入(最"适合 Hermes Agent"的做法) Hermes 原生支持 MCP 客户端,hermes mcp add 把服务器加进去,工具自动注册,检索就变成 agent 的原生工具调用: Qdrant 官方 mcp-server-qdrant,配本地 embedding Chroma 的现成 MCP server 官方 mcp-server-memory(知识图谱式记忆,适合沉淀研究笔记) Embedding 用 bge-m3 或 Qwen3-Embedding-0.6B 本地跑,Ollama 一装就有,你 M5 Max 64GB 统一内存毫无压力。 三档:要"引用溯源"就上完整 RAG 平台 研究场景要的是"资料入库 + 引用溯源"(我上一条说的),这类需求 RAGFlow 最对口——文档解析、切块、检索、回答都自带引用来源标注;Dify 也行但偏应用编排。两者都能本地部署、接 Ollama 模型和本地 embedding,Hermes 通过 API/MCP 调它。代价是部署和维护成本高一个量级。 建议路径:先一档跑起来,资料多了、发现检索不准再上二档;真到写论文要逐条引用时再考虑三档。别一上来就搭重型 RAG——你 35B 还要占内存,轻量方案体验好得多。
  • DIY Mac Touch ID 小键盘

    AI硬件 mac
    6
    4 赞同
    6 帖子
    187 浏览
    Tony WangT
    @williamlouis Chrome 记录的各个网站密码, 还有password记录的密码, 用这个触碰一下, 都能自动填充. 这个是最方便的.
  • 1 赞同
    14 帖子
    478 浏览
    terryT
    @SuperBat 可以接受涨价,不超过100%就行。