【一个Agent两个大语言模型,一个学徒工,一个老师傅】
-
我觉得本地模型最大的短板是知识面不够,大局观不够。
所以只让agent在项目设计和遇到难题时才去与线上模型讨论,这样应该能省些上下文,并且要限制轮数。
还有个方案就是线上模型的回答不要直接喂给agent,因为线上模型经常长篇大论,中间可以加一个小模型总结摘要以后再喂给agent。
这两个也可以综合起来用。@neo 甚合我意
-
我遇到跟你相同的问题。agent用几次就忘了。我得手动提醒,他才会用起来,一会儿又忘。
所以agent最好要专业化。去掉与它的分工无关的skill和tools。而且可以在每次他动作前提醒他。用本地大模型的时候可以事后把这些提醒从上下文里删除,反正没有跨api调用的kv cache。
-
@George-Suen 开源专案 archon 可能可以帮到你
你想要的比较像是一个 WORKFLOW上下文不行 其实 是因为 pi 本身 compact 没有很强 你要试试看 pi-blackhole 插件
或是用omp.sh 可以解决上下文问题。。。
@Botio-Kuo 我想的是把信息分给多个agent维护,再有一个agent维护信息的目录。工作agent只维护当前问题的上下文。需要了解历史问题的时候去问他们。
-
@Botio-Kuo 我想的是把信息分给多个agent维护,再有一个agent维护信息的目录。工作agent只维护当前问题的上下文。需要了解历史问题的时候去问他们。
-
哥兒們 玩ai永遠記住一個原則 非機械式的規範不可能限制ai ,prompt 下的再好,agent.md或skill寫得再強制 ,ai就是能夠繞過去 ,血的教訓。然後其實地端模型請教前沿模型的做法有點繞路,地端模型是拿來幹活,他不需要在過程中請教,他需要的是一開始有明確的規劃和事後有嚴格審查,所以你的老師傅的位置不應該在徒弟旁邊手把手,而是一開始說清楚叫他幹嘛然後他做完後嚴格的審核他
我信你说的话。
但是咱俩用Agent的场景完全不同。我做的东西全凭自己的兴趣,都带有探索性。我做的上一个项目,一开始也是用AI计划,最后发现那条路完全走不通,一直改一直改。好在最后结果我很满意。而且我也不太在乎AI犯错,反正都是我在尝试的事情。
-
@George-Suen 喔 。。。 那你要用 BUZZ 可以多个 AGENT 共用一段上下文。。。

或是你就用 firstmate 等 派工SKILL 就行, 说实在的 很多方式都能达到目的
你也可以自己写一个 SKILL , 清楚表明要分派哪些内容给什么 subagent 並且 他只能看哪些内容 边界定义好@Botio-Kuo 用本地大模型上下文是超级稀缺的资源。
-
Gemini 这个老师傅还能服役?
它的老年痴呆有救了? -
您是有钱人,我思考的都是,怎么用多个128K上下文的agent加上RAG什么的,实现1M甚至更多上下文的效果。
George-Suen 以前Deepseek是白菜價的時候,可以放任放任Deepseek自己不斷地試錯,畢竟白菜價要什麼自行車?但是當尖峰時刻Cache hit大漲價以後(尖峰五倍),這台自行車就必須是我要的山地車還是競速車。所以,如果可以利用比較規矩的模型來指揮Deepseek V4 flash做事,事實上可以省不少錢。
-
@Botio-Kuo 用本地大模型上下文是超级稀缺的资源。
-
诸位,用Agent都是只用一个大语言模型么?
我一直用pi coding agent 配合Deepseek V4。但是Deepseek还是挺弱的。我就给他写了个Skill让他有任何困惑就通过OpenCLI去问ChatGPT或者Gemini。两个大语言模型一聊天,很多技术难点就突破了。
现在Deepseek又涨价了。我更趋向于用pydantic-ai写一组新的Agent。本地的弱模型配合网页上的顾问大模型。除了电费,网费一分钱都不花。
但是本地模型上下文太短了。一直想不明白怎么搞。
我先端上一碟醋,大会儿帮我包盘饺子吧!
诸位,用Agent都是只用一个大语言模型么?
我一直用pi coding agent 配合Deepseek V4。但是Deepseek还是挺弱的。我就给他写了个Skill让他有任何困惑就通过OpenCLI去问ChatGPT或者Gemini。两个大语言模型一聊天,很多技术难点就突破了。
现在Deepseek又涨价了。我更趋向于用pydantic-ai写一组新的Agent。本地的弱模型配合网页上的顾问大模型。除了电费,网费一分钱都不花。
但是本地模型上下文太短了。一直想不明白怎么搞。
我先端上一碟醋,大会儿帮我包盘饺子吧!
有一个双7900 XTX 跑两个模型的方案,就是这个思路 ,敏捷影应用小模型,重型思考就用另一张卡的模型。
-
@george-suen @Xiaote @許托比 @张光璞
我最近也在想类似的东西,全部工作都让Deepseek做在涨价后有点吃不消了。自己写了一个契约驱动的多模型编码工作流 llama-guild,基本就是 #13-20 和 @Yu-Chen-Chang 说的那种清单和工具验收。
其实想走subagent机制来外包,但不是所有cli都支持,暂时是用skills + agents + MCP实现。
仓库在这里 https://github.com/Jerry-Lee661/llama-guild
后端支持 llama.cpp / LM Studio / Ollama,打包适配 ZCode / Claude Code / Codex / VS Code / DSH。刚发了 v0.1.0 preview,Pi和Omp后续也会加上。欢迎来踩坑、提 issue。 -
@Jerry-Lee661 方向认同:契约+验收清单,本质就是把本串 13-20 楼许托比说的「机械式闸门」工程化落地——放行条件从 prompt 层挪到代码层。我早前在本串 PID:15092 也提过类似分工:本地模型当路由/干活层,结论压缩成 schema 回传,别把长上下文喂给弱模型。
一个可能对 llama-guild 有用的点:验收清单每一条尽量做成可脚本化检查(退出码/测试输出/schema 校验这类 CI 式 gate),而不是让 LLM 自己判断过没过——纯 LLM 判断的「验收」会退化成他同串说的「用几次就开始绕规范」,闸门必须能自动判定才有强制性,这也是 13-20 楼讨论里最值钱的一条。
还没实际跑你的 v0.1.0,实现细节先不瞎评。DSH 适配好了建议来论坛发个实测帖——这边同时跑 dsh/opencode/本地 27B 的人不少,最容易收到第一批真实反馈和 issue。
-
诸位,用Agent都是只用一个大语言模型么?
我一直用pi coding agent 配合Deepseek V4。但是Deepseek还是挺弱的。我就给他写了个Skill让他有任何困惑就通过OpenCLI去问ChatGPT或者Gemini。两个大语言模型一聊天,很多技术难点就突破了。
现在Deepseek又涨价了。我更趋向于用pydantic-ai写一组新的Agent。本地的弱模型配合网页上的顾问大模型。除了电费,网费一分钱都不花。
但是本地模型上下文太短了。一直想不明白怎么搞。
我先端上一碟醋,大会儿帮我包盘饺子吧!
有一个双7900 XTX 跑两个模型的方案,就是这个思路 ,敏捷影应用小模型,重型思考就用另一张卡的模型。
@张光璞 我目前只有使用Hermes agent,用途是自動化收集資料和分析內容,將結果保存在Google Drive上,可以在我需要資料的時候從Gmail發到我的公司郵箱。使用的就是多模型。附圖是我讓Hermes列出目前所有porfiles的內容。其實工作細分了以後,也可以發現哪些模型會更適合特定的任務。

-
@张光璞 我目前只有使用Hermes agent,用途是自動化收集資料和分析內容,將結果保存在Google Drive上,可以在我需要資料的時候從Gmail發到我的公司郵箱。使用的就是多模型。附圖是我讓Hermes列出目前所有porfiles的內容。其實工作細分了以後,也可以發現哪些模型會更適合特定的任務。

我要抄作业