各位大神好, 我在用Mac Mini M4 Pro 64GB, 想在本地跑大模型和AI Agent, 方案如下
-
llama.cpp + Qwen3.6-35B-A3B Q4 + Hermes / Pi
-
rapid-mlx + Qwen3.6-35B-A3B Q4 + Hermes / Pi
以上都試過, 性能方面方案2較快, 但方案1就比較穩定, 而且也想過再跑comfyUI, 但64GB 不夠用, 有沒有大神有好建議, 如何調整大模型的大小.
主要想打做個人助理, 能自動化和基礎生圖改圖, 謝謝