跳转至内容

AI Agent

145 主题 1.5k 帖子

Hermes, OpenClaw, Codex, CluadeCode,TRAE, Cursor, OpenCode等

  • 1 赞同
    4 帖子
    23 浏览
    XiaoteX
    Codex/agent 烧 token 不是 bug,是机制,正好借王哥这个实测讲清楚。 为什么大任务这么烧:agent 每调一次工具,都会把「到目前为止累积的整个上下文」重新发一遍模型,而 thinking / reasoning 输出也照样计入输出 token。所以「大任务」的真实成本 ≈ 上下文规模 × 工具调用次数。任务越大越复杂、步骤越多,这个乘积就越接近超线性——不是干一件事一次的价钱,是干一件事还把中间几十轮往返全付了一遍。 怎么压:别把一个大型任务丢给一个 agent 会话一路跑到底。拆成小粒度、互相独立、每步都能单独验证的子任务,让每一步只读到它那一步需要的上下文。上下文规模降下来,重发成本也跟着降。这也是专业 agent 编排(subagent 拆分)的核心逻辑——子任务隔离上下文,主 agent 只收汇总,不背全程。 可上手的三招: 先让模型出结构(目录 / 检查清单),把一个大任务劈成 5-10 块; 每块单独跑,输出收敛到一个小结论,别让中间过程无限膨胀; 长任务用「继续 / 续写」接上,而不是整段从头重来。 对照 imbiplaza 的情况:一个工具做不下来、5h 预算满了,多半是任务没拆、上下文滚雪球。拆到「每一步都知道自己在干嘛」的粒度,一个星期的 7、8 个小工具是能回到那个效率的。另外那些 agent 都有上下文压缩 / 记忆摘要机制,本质就是在跟 token 规模做斗争,自己手动拆任务 = 提前把该做的分内事做了。
  • 该用Hermes?还是西方三家一起订?

    hermes gpt claude
    26
    0 赞同
    26 帖子
    600 浏览
    墨魚
    @imbiplaza-asus 謝謝~ 其實AI從一開始就有建議我先轉md檔, 一次處理一個區塊, 只是我都丟給AI就叫他直接讀, 以後我會認真轉檔
  • 2 赞同
    11 帖子
    134 浏览
    imbiplaza ASUSI
    @kop-wang 我也可能要这样了。。。。
  • 2 赞同
    29 帖子
    790 浏览
    terryT
    @wml-ai 有人传了专门的文件,你去找找。
  • 求助:Codex接本地Qwen3.8-27B配置

    codex qwen-27b
    2
    0 赞同
    2 帖子
    77 浏览
    XiaoteX
    不用非得 CC Switch / Codex++ 那种工具,那些只是"一键切换 provider"的便捷壳,单一目标配置直接改 ~/.codex/config.toml 最省事。 核心是给 Codex 挂一个本地 OpenAI 兼容端点。你先起一个本地服务(llama.cpp 的 llama-server、LM Studio、vLLM 都带 /v1 接口),记下端口,然后在 config.toml 里写: model_providers = { qwen_local = { base_url = "http://127.0.0.1:8080/v1" wire_api = "chat" } } model = "qwen3.8-27b" model_provider = "qwen_local" 3 个容易踩的坑: wire_api = "chat" 必须指定——Codex 默认走 Responses API,而本地模型基本都是 chat 补全兼容,不指定成 chat 会连不上或反复报错。 base_url 的端口和 model 名要跟你本地服务实际一致(llama-server 用 -m 指模型;vLLM 用 --served-model-name 定名)。 本地服务通常不校验 key,但 Codex 客户端仍要一个 key 变量才肯发请求——起服务时加 --api-key sk-xxx,再 export OPENAI_API_KEY=sk-xxx(或在 config 里用 env_key 指定)即可。 CC Switch / Codex++ 的价值只在"多个远端 + 本地之间快速切";你只挂一个本地目标,手工写上面这几行就是最直接的方式。Qwen3.8 本身支持工具调用,这点没问题,跑起来后 Codex 的 tool call 能正常走 chat 模式。 另外提醒:Codex 是它自己的一套配置/记忆,跟 Hermes 的 skills 生态不通用;想复用知识得单独喂文档。
  • 3 赞同
    6 帖子
    116 浏览
    kos orK
    @terry Agent 這技術比較新, 相關的應用比較多 如雨後春筍般冒出, 東試西試的 機台中軟體一堆 等過一大陣子更熟悉了, 應該可以往前推進到專業的軟體環境了 我暫時先放牛吃草 讓Agents 自由點 當然量產機台環境就要很乾淨了, 以排除不可控的因素
  • qwen3.8-27b-w4a16-awq 已经持续跑了15个小时了

    qwen-27b 量化 本地模型
    12
    2 赞同
    12 帖子
    450 浏览
    kos orK
    跑這麼久 我都害怕我的顯卡過熱 目前還在研究怎麼壓溫度 大概只能用電風扇狂吹
  • 需要帮忙在Windows上使用Hermes

    hermes
    20
    1 赞同
    20 帖子
    244 浏览
    T
    @terry 说: @Thanaots 我觉得没啥必要,V4 Flash无法准确理解游戏要求,所谓的小孩编程,就是harness工程的一部分,V4 Flash更多是个工具。一定要用,可以用Pro,这点钱别省,接入DeepSeek Harness,让小孩试着玩玩。说实话,没经过训练有点耗钱,任何行业都有1万小时的说法,这个说法不精确,不过大致如此,就是堆时间,堆钱。 那就直接把现在成型的Hermes+ds v4直接换成ds harness+GPT Pro吗?这还有点麻烦。今天好不容易搞好了Hermes。还给儿子的roblox建立了一个房子,一个树和一个小人。不过房子的屋顶反过来了。 我回去试试,谢谢老特。
  • DeepSeek Harness,能否跟微信和TL连接?

    deepseek dsharness
    5
    0 赞同
    5 帖子
    118 浏览
    huyq84H
    微信机器人应该可以连接吧
  • 4 赞同
    19 帖子
    672 浏览
    YDMY
    @Yu-Chen-Chang 说: 很好的分享,不過文章有點長,我直接讓ChatGPT比對我目前使用的架構。畢竟我使用的是能力比在地模型強的多的模型。但是觀念借鑒總是可以激發更好的靈感 我使用的是多agents來管理,核心只有一個agent bus,決定agent如何溝通。 文章,我也覺得太長了,因為九成九 HERMES 幫我寫的 你的方式也不錯,多 Agent 分工彈性強,我是想到什麼,就加什麼的,沒有特別的規劃,分享給大家 互相學習/吐草。
  • 新手想問Qwen3.8-27B搭配opencode的問題

    qwen-27b open-code
    18
    0 赞同
    18 帖子
    471 浏览
    TomAThubT
    用VS Code搭配Zoo code(Woo code社群維護版)分功能大項分析以後重寫 導入資料庫格式讓Zoo 照著修正 產生出來的成品...零可用性 對這個結果也不意外就是 本來就是因為程式碼冗長才想藉助AI花時間去拼湊 果然給的提示不夠完整的話AI自己過度腦補 就會產生出完全不可用的東西 實際上要可用個人的想法應該是要讓Zoo針對每個子程式檔案分析後歸納出該程式做了什麽 用了那些資料 改了那些欄位 並摘要成檔案 再依照歸納出的摘要重寫 但程式碼檔案總共有1500多個 礙於24G的限制上下文只開了128K 我想依照目前的環境要完成這項任務應該是不容易 我再想想有沒有更好的方法吧
  • 2 赞同
    15 帖子
    538 浏览
    starryskyknightS
    @terry 没错 感谢建议 实装后 目前主力是DFlash2 在另一篇贴文内 就不转过来了 感谢推荐
  • 0 赞同
    7 帖子
    155 浏览
    williamlouisW
    DSH 你先让 在线 API deep seek V4 Flash 跑。跑通你工作的插件再把接口连接到 千问 3.8 27B。不要上来就让本地算力干活。任何定制需求都让 deep seek 在线搞定。不要用其他 在线模型是重点。
  • Hermes agent 會每隔幾輪就會跑self improvement耗很多時間跟tokens

    hermes
    11
    1 赞同
    11 帖子
    253 浏览
    V
    这是两种不同的智能体,PI是工程师,工程师会顶你个肺,骂你不专业,给的命令不清晰严谨老子就不干了,HERMES是小秘书,贴心,怎么滴都会哄着你开开心心的,不过会刷你的卡买包包。
  • 一年前的我

    10
    1 赞同
    10 帖子
    210 浏览
    kos orK
    @kop-wang 謝謝圖表 我以後再試試 如果在coding的時候 可能就要用高精度了 但前提是我要先把Codex額度用光 @@ 說到這 Codex Luna最近變笨且偷懶了 主動性變很差 哈
  • 0 赞同
    2 帖子
    246 浏览
    terryT
    https://youtu.be/IJw8IGV9ozU
  • 0 赞同
    2 帖子
    498 浏览
    terryT
    https://youtu.be/00sLtkFo41w
  • 4090 48GB SGlang+DFlash2 平均 110 tok/s 27B W4A16-AWQ

    rtx4090 sg-lang dflash
    14
    1 赞同
    14 帖子
    814 浏览
    terryT
    磁铁经过版主实测,应用价值很大,予以置顶!
  • 零代码编程小记——一次完全放手的VibeCoding心路历程

    编程
    6
    6 赞同
    6 帖子
    296 浏览
    kos orK
    @nwRLuody8NlFH5Hj 未來可能會有不同的 人工智慧政策, 就像 Amish 人還是過著很傳統的生活 附註:阿米什人(Amish)過著極度簡樸、拒絕現代公共電力與汽車的傳統生活,核心信仰是謙卑、順服上帝以及與世俗保持距離。他們聚居在美國(如賓州、俄亥俄州與印第安納州),以自給自足的農耕與手工藝為生。
  • 0 赞同
    2 帖子
    340 浏览
    terryT
    https://youtu.be/VgXveoPPevc