Hermes 自进化 Agent 框架-根据论文SkillOS已经实战部署
-
我给本地AI装了个「后台班主任」:16G显卡就能跑,越用越聪明,还不会偷偷改我文件
你有没有过用本地AI写代码写到崩溃的时刻?
-
现在的AI软件吹得天花乱坠的「AI自进化」全是噱头:要么要充钱用云端API,要么就是个作文润色器,教过的东西转头就丢,根本不会自己长记性。
-
写了俩小时代码,上下文一压缩它突然抬头问你:「我们现在要做什么来着?」之前改了一半的文件、踩过的坑全清零,得从头给它讲进度;
-
花半小时教它「改代码前先备份」「别乱改我的项目配置」「HMAC错了先看nonce」,新会话一开全忘光,该踩的坑一个不落;
-
为了防它乱改文件装了代码门禁,结果自己改个脚本被自己的锁卡半小时:改一行等3秒审查、令牌过期重来、HMAC不匹配重来,像锁匠换锁把自己锁在门外;
点我查看技术细节可直接丢给Hermes使用: Hermes自进化框架_部署指南.md
我使用Hermes大概2个月踩了无数坑,照着Google/UIUC/MIT最新的SkillOS自进化论文思路,做了个普通人16G显卡就能跑的「自进化Agent框架」——没有花里胡哨的概念,就是给你的AI配了三个专岗专人的后勤,彻底解决上面这些破事。
论文出处感兴趣的可以去看一下:SkillOS: Learning Skill Curation for Self-Evolving Agents arXiv:2605.06614, 2026 年 5 月 Google Cloud AI + UIUC + MIT https://arxiv.org/abs/2605.06614
它到底给AI加了啥?说人话版
没有改Hermes一行核心代码,全是插件+定时脚本,装上就能用,本质就是把以前AI一个人干三个人活的烂摊子拆了:以前AI既要写代码干活、又要记笔记总结、还要自己管纪律,当然干不好;现在三个岗专人专干,互不干扰。
️ 第一个岗:不轴的保安大爷(带临时通道的代码门禁)以前的门禁是死脑筋:不管是你自己改安全脚本,还是AI想偷偷改文件,一律要查三遍身份证,改一行代码走三遍流程,半小时活25分钟在给门禁开证明。
现在给保安加了个15分钟临时通行证(Break-Glass维护模式):- 你自己要改curator、门禁脚本这些核心安全文件的时候,输一行命令开个临时通道,白名单里的6个核心文件暂时免审查,改完自动锁门,最长30分钟自动过期,根本留不下后门;
- 普通业务代码、AI想乱改的文件,还是该怎么查怎么查,HMAC指纹锁照样防伪造,AI想自己写假审查结果根本不可能;
- 所有临时通道的操作全记日志,谁什么时候开的、改了什么,查得一清二楚,连maintenance.py自己都不在白名单里,想开永久后门?门都没有。
效果:改自己的安全脚本从半小时缩短到3分钟,既防住了AI乱改东西,又不会把你自己锁在外面。
第二个岗:半夜偷偷加班的学习委员(独立策展器)以前AI学东西全靠缘分:写代码的时候想起来就记,写嗨了就忘,同一个坑踩十次下次还踩。
现在学习委员是个完全独立的后台进程,白天你用AI干活它根本不出来打扰,等你半夜睡觉了,它自动把模型切到Gemma4-12B,花几分钟把你一天的对话、改的文件、踩的坑、甚至门禁的拦截记录全翻一遍:- 同一个错误踩两次(比如三次遇到HMAC不匹配、两次遇到钩子不触发),它就自动写成标准技能,过了审查下次AI直接用,再也不犯;
- 不光记错误:你第一次试了两次就解决的问题(比如怎么给Hermes打补丁、怎么启动模型),它也会把步骤整理成标准流程,下次遇到直接用,不用瞎试;
- 绝对不瞎改规则:新发现的坑必须跨两个会话都验证过,才会正式记成技能,不会一次出错就乱加规则搞崩环境。
最爽的是:全用你本地的模型跑,不花一分钱API钱,16G显卡刚好够——白天Qwable 9B常驻做代码审查,半夜自动切Gemma搞总结,跑完自动切回来,根本不耽误你白天用。现在它已经自动学会第一个技能了,跑了三天没出过错。
第三个岗:记作业的课代表(跨会话状态追踪)以前上下文一压缩AI就失忆,本质是它没有个固定的小本本记进度。
现在你每改一个文件、每完成一步操作,课代表都会自动在项目目录的小本本上记下来:- 现在在做什么事、改了哪几个文件、哪个文件改了一半没写完、下一步要干嘛;
- 新会话一打开,AI先看这个小本本,不用你重复说进度,上来就接着上次的地方干,再也不会问你「我们刚才在做什么」。
记一笔的时间不到10毫秒,你根本感觉不到它在运行,但是再也不用给AI重复讲进度了。
和官方自带的「自进化」比,强在哪?
Hermes官方也有个自进化包叫GEPA,说白了就是个作文润色器:你已经写好的规则,它帮你改改语句通不通顺,根本不会自己找新问题、记新坑。
我们这个是真的「学习委员」:功能 官方自进化 我们的框架 发现新技能
只会润色已有规则
自动翻一天的对话找坑、找好用的流程技能验证 一次过就改
同一个坑跨两次会话验证才记,不瞎改数据源 只看已有技能
对话记录+改文件记录+门禁日志全看运行方式 和AI抢资源
独立后台进程,半夜跑不打扰你干活成本 依赖云端API
全本地模型,16G显卡就够,零成本安全 无保护
所有自动改的内容过门禁审查,还有10个备份自动恢复记进度
压缩就失忆
自动记作业,新会话直接接着干等后续路径污染的小问题修好了,还能把官方GEPA接进来当「作文润色器」:学习委员找出来的新技能,让GEPA把语句改得更通顺,俩配合着来,效果更好。
新手最关心的问题:我能用吗?
零门槛:不用改Hermes源码,全是插件和脚本,照着步骤复制命令就能装;
不挑硬件:16G显存(3080/4070/5070Ti这个级别的卡)就能跑,不用24G大显存,不用买云端算力;
Windows优先:路径自动适配Windows的AppData目录,不用折腾Linux命令,普通用户也能装;
不瞎搞:所有自动修改的内容都过门禁审查,还有10个核心文件的自动备份,升级搞崩了cron会自动恢复,根本不会把你环境搞坏;
不吹牛逼:明明白白告诉你什么拦不住——比如base64混淆的恶意代码、你自己手动鼠标点的操作,这些拦就是拦不住,不吹100%安全。
最后说句实在的
以前的本地AI更像个用完即弃的工具人:每次用都要从头教、擦屁股,教多少忘多少,永远像个刚入职的实习生。
装完这个框架之后,它是真的会慢慢记住你的习惯、踩过的坑、常用的流程,你用得越久它越顺手,真的像个能一起干活的搭档——而不是每次都要从头教的傻子。
毕竟AI真正的自进化,从来不是靠吹出来的大模型参数,而是真的能把你踩过的坑、摸出来的经验,一点一点记下来,下次不再犯。 -
-
感谢大佬分享!顶!
-
大佬你好 我没看到您的脚本在哪里
scripts/ → curator.py、model_switcher.py、watchdog.py
plugins/ → auto-checkpoint、iron-law-enforcer、code-review-gate这些在什么位置?
-
大佬你好 我没看到您的脚本在哪里
scripts/ → curator.py、model_switcher.py、watchdog.py
plugins/ → auto-checkpoint、iron-law-enforcer、code-review-gate这些在什么位置?
-
这些是给 Hermes Agent(Nous Research 的 AI 代理框架)做增强的组件:
plugins/(插件,挂在 Hermes 的钩子系统上):
code-review-gate— 代码审查门禁:每次用 write_file/patch 写代码时自动拦下,跑本地模型审查,通过才放行iron-law-enforcer— 安全铁律:拦截危险命令(rm -rf、fork 炸弹等)和终端直接写文件的绕路行为(重定向、here-doc、PowerShell)auto-checkpoint— 改代码前自动保存检查点,改崩了能回滚
scripts/(独立脚本,供 cron 定时任务调用):
curator.py— 策展器:定期分析历史会话,把重复犯的错误提取成技能,让 AI 自我进化model_switcher.py— 模型管理:按任务切换本地/云端模型watchdog.py— 兜底守护:每 30 秒扫描未审查的文件
都是自用增强,配合 Hermes 的门禁体系用的。
-
@znx 你等我在测两三天门禁系统和自进化框架。这些脚本和插件不是门禁系统自带的,是我自己写的一套增强组件。部署门禁(code-review-gate)只是基础,curator.py、watchdog.py 这些是我的自定义脚本,我给你提供一下我自己写的增强组件Hermes门禁增强组件.zip
如果你只部署了 Hermes 自带的门禁,是看不到这些文件的。压缩文件里面有MD文件安装说明,直接丢给你的Hermes按着MD文件安装就行了