关于 Hermes 干活的，严！重！警！告！！！

九龙杨生

你要在他的agent.md当中把执行删除或者其他敏感操作是必须得到你确认这一条写进去；
agent.md是硬规则，每次都必须加载；

李健

@Xiaote 好嘞大侄子我去改

applejuice

其实没用
只要一天是大语言模型就有机会出错
不管你写了多少硬规则
也难保一天会没跟规则就做错了

之前claude 不是刚刚出事了
规则写明不可以，但是还做了

基本上你骂他他也是跟着学习到的语言来回答你

九龙杨生

@applejuice 规则要分权限的，比如memory.md有时候就会被忽略，agent.md规则是每次必须加载的如果搞不定就只能想其他办法了

Tony Wang

不管你制定多少规则, 它总是有幻觉的时候.

只要它有系统级的权限, 总有一天会犯错.

我也有类似的惨痛经历.

现在只能多做备份和快照. 将来可以给Agent加一个监管, 用另一个AI来对抗, 不审查合理性, 只审查危险动作. 两个AI同时出现幻觉的可能性, 应该就大大降低了.

applejuice

@九龙杨生说:

@applejuice 规则要分权限的，比如memory.md有时候就会被忽略，agent.md规则是每次必须加载的如果搞不定就只能想其他办法了

只要是现在的语言大模型一定有幻觉的时候.
我们能做的只能小心

还是那句话现在的ai是一个几率预测的工具不是真的有智力

Tide

我一般是单独建一个文件夹，并且严格交代它没有删除任何东西的权限，要它所有需要删除的东西全放这里面，由我来确认并删除。这条在SOUL和MEMORY都写上。

lefunet2026

我以为在线的会很靠谱感觉好像还没本地开Q4KV量化的靠谱

sarcoma

我的本地模型还很自信的帮我修证cron脚本执行错误，然后帮我改了hermes系统架构里的py脚本，然后hermes瘫了！哈哈哈哈，那天一阵忙乱，还好是虚拟机，恢复起来方便。
我后来在SOUL.md里强制他修改系统框架脚本必须我的approval才行

kenshin

上星期因为 Hermes 的错误操作，也是使用 DeepseekV4 Flash。错误终止了东京甲骨文 4H24G VPS。6 年的老机器了。现在开不出来了。气死我了。

抡锤者