你们Hermes 接入Agnes模型没有?不要钱
-
注意 除非是知名的 API 路由。陌生的请保持警惕。
警惕内容可以自行搜索。(强调有风险。真的有风险。) -
跑Hermes的话,日常操作用Qwen3.6-35B越狱版模型就很香,量化版本可以放在8g,12g的卡上跑,但是量化版本越低,智力越差,我3060 12g,跑Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M(19.7g)这个版本还是没问题的,用着不卡,智力还行,日常操作没问题,主要是100%越狱,所有敏感测试全部通过,可以做任何事;
做有难度的任务还是用codex上gpt5.5吧,或者换成v4pro内核也行
跑Hermes的话,日常操作用Qwen3.6-35B越狱版模型就很香,量化版本可以放在8g,12g的卡上跑,但是量化版本越低,智力越差,我3060 12g,跑Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M(19.7g)这个版本还是没问题的,用着不卡,智力还行,日常操作没问题,主要是100%越狱,所有敏感测试全部通过,可以做任何事;
做有难度的任务还是用codex上gpt5.5吧,或者换成v4pro内核也行
大佬,我目前的配模型,基本按你的逻辑的,就是没完全配好模型,v4 flash兜底模型,深度思考还没想好用啥,v4 pro 好像不咋聪明。
-
你们都是这么有钱吗? 不是自建就是花银子买 TOKEN.
我是新手, 入门hermes大概才两三个月, 不过从来没花过钱.
刚开始是自建大模型, 用的是AMD 8845HS CPU 自带的核显和 32G内存,
llamacpp + vulkan , 能跑起来, 但速度不能忍.
后来用国外免费openrouter 等 , 也是速度不能忍.
退回国内, 阿里云免费百炼计划, 一天要换好几个模型的免费额度媷, 太麻烦了.
直到它的出现----deepseek v4 flash 免费用,
有人知道我说的是哪里吗?
我怕说出来羊毛给媷秃了, 我也没的使了
所以不敢说
-
agnes实测体感不好,首先首token基本是10s左右,挂不挂代理都一样。
其次是RPM20-30约等于无效,在大概可能的繁忙时间,常会conection error,运气好1分钟后正常,运气不好要好几个1分钟。
总结来说:等的起,且让它跑的任务不是很紧要的,可以用起来。
我现在的用法:moa的小编模型,聊胜于无吧。 -
版主注:非知名模型API,请坛友注意信息、隐私安全,合理使用。不要钱,那必须得用用啊。deepseek的钱又可以省省了。
https://platform.agnes-ai.com/settings/apiKeys 这里生成新key。
然后把这段话发给heremes让它自己搞hermes config set model.provider custom
hermes config set model.base_url https://apihub.agnes-ai.com/v1
hermes config set model.api_key 你的key
hermes config set model.default agnes-2.0-flashhermes可能需要让它自己重启,或者你帮它重启一下。用新模型Agnes
目前我切换到这上面了,先试试,反正不要钱。
-
跑Hermes的话,日常操作用Qwen3.6-35B越狱版模型就很香,量化版本可以放在8g,12g的卡上跑,但是量化版本越低,智力越差,我3060 12g,跑Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q4_K_M(19.7g)这个版本还是没问题的,用着不卡,智力还行,日常操作没问题,主要是100%越狱,所有敏感测试全部通过,可以做任何事;
做有难度的任务还是用codex上gpt5.5吧,或者换成v4pro内核也行
@云海过客 大家好,想问问8gb的显卡跑得动,rtx2060s 跑得动吗?