@kop-wang 謝謝你的回覆, 創意內容以外確實沒有什麼隱私考慮, 拒絕內容我覺得也不太會碰到, 我主要是想ai協助我做一些cron job, 如網上資料搜集和分析, 和對本地檔案做些整理, 偶爾寫簡單腳本. 這樣使用deepseek會比本地跑32b好很多是嗎? 图片解析我會本地跑個8b模型的. 因為硬件都已經有了, 想法是能用就用.
至於創作方面似乎只有本地跑27B.
@kop-wang 謝謝你的回覆, 創意內容以外確實沒有什麼隱私考慮, 拒絕內容我覺得也不太會碰到, 我主要是想ai協助我做一些cron job, 如網上資料搜集和分析, 和對本地檔案做些整理, 偶爾寫簡單腳本. 這樣使用deepseek會比本地跑32b好很多是嗎? 图片解析我會本地跑個8b模型的. 因為硬件都已經有了, 想法是能用就用.
至於創作方面似乎只有本地跑27B.
@Tony-Wang 謝謝你的回覆. 如果分開兩個思路, "邏輯"和"創作", 就是把財務/生活上的事務這些重複和資訊性的配一個知識面模型, 創作上的任務配另一個智力模型, 這種思路正確嗎? 如果正確, 那創作/生產力抄大佬們作業配Qwen 27b應該是不二次選, 但 "邏輯"方面是不是用max 395配個32B就足夠了?
我沒有很大的生產需求,硬件也就以下這些, 所以不強求速度, 但想在不額外購置硬件下最大化使用ai agent, 各種任務都想試跑下.
我的思路是:
265k+4090d 24gb+32gb ram = 原本的工作機, 跑Qwen 27b, 會跑comfyui+生產力任務(未想到是什麼
)
AI max 395 64gb筆電 = 跑Qwen 32B, 日常任務/cron job, 強度低
Intel N150 mini pc = Deepseek api
在想, 以我的用法, 是不是洗洗睡, 就用mini pc 24/7配deepseek算了, 反正tokens使用成本低到可以忽略, 不要折騰. 想參考下大佬們的思路.
我已經轉用ubuntu desktop, 確實感覺比較絲滑, Hermes agent表現確實比openclaw好, 暫時沒有各種惱人的報錯, 也沒有想要用回openclaw, 但我也只是日常用途, 沒有大佬們複雜, 唯獨配置llama.cpp現階段對我來說有點太複雜, 沒法往極致效能走, 我是在用Lemonade server, 較易入手, 速度上也夠用.