这帖子确实垃圾,啥玩意。
Hank Wang
-
24B左右的模型推荐,其实没必要删帖,本来就是讨论,不讨论怎么分得出对错好坏 -
我用Trae接入Deepseek的API居然失败?Why?没必要死磕。直接上claude或者pi Agent。支持都很好。
-
用AWS Sagemaker LoRA 垂直模型,下载下来本地推理,性价比最高不知所云
不知所云 -
你们Hermes 接入Agnes模型没有?不要钱这网站跟我毫无关系,如果收费了就别用了。免费那还是可以的。
-
你们Hermes 接入Agnes模型没有?不要钱版主注:非知名模型API,请坛友注意信息、隐私安全,合理使用。不要钱,那必须得用用啊。deepseek的钱又可以省省了。
https://platform.agnes-ai.com/settings/apiKeys 这里生成新key。
然后把这段话发给heremes让它自己搞hermes config set model.provider custom
hermes config set model.base_url https://apihub.agnes-ai.com/v1
hermes config set model.api_key 你的key
hermes config set model.default agnes-2.0-flashhermes可能需要让它自己重启,或者你帮它重启一下。用新模型Agnes
目前我切换到这上面了,先试试,反正不要钱。
-
我今天终于干了个大活。震惊了我的同事。你要是老板就好。你要是打工的就没那么好

-
R9700 ai pro 32G 跑大模型还是很给力的,速度也不错35b没有意义,a3b可能跟4b或者9b能力差不多。写的代码基本都是无法运行的。看着生成一大堆代码,一堆错,调试能力更是没有。假装一顿调试,结果出更多bug。27b明显能力高出一截,经常是正确代码,有错也勉强能自己调式
-
VSCode官方放开了模型的自定义配置功能,可以在Copilot中配置自定义模型供应商API了我试试。第一眼是慢。再看看
-
Qwen3.6-35B Q8_K_P量化配合CC搞出的八卦页面也不错CC在这里起作用没有?
-
从纯游戏机改成游戏+AI双用机,Qwen 3.6 27B MTP 速度只有 37 t/s,求大神指点怎么升级对。楼上言之有理。卖掉慢卡,上5090
-
5090 + vLLM + Qwen3.6-27B 成功分享要搞到110,否则就浪费了这个卡
-
codex 现在额度大减,问了一个项目方案问题,然后让他帮我找本地电脑文件,5个小时额度就没有了。啥时候开始减的?
-
需要理解怎么搬运Windows下的wan2.2到Linux能实现。接网线ssh上去就可以了。网页在另一台机器访问。但是意义不大。桌面显存占用300m左右。除非你真差这一点
-
RTX 3080 20GB 上以 256k / ~45 tk/s 运行 Qwen3.6-35B-A3B-Q4-K-M(ubuntu)45 每秒太慢了.需要调。接Agent让它自动测试最高速度。
-
M5pro 64G LLM性能参考.不错。这机器不便宜。能跑27b的都不错。
-
两张5060ti 16g想部署qwen3.6 27b用来写代码4080s 32g 跑27b肯定可以跑。双卡不是3090的话估计意义不大。
其他机器貌似也跑不太动27b, 64g的Mac估计能跑,但是估计很慢。建议4080s -
4060Ti 8G显存还能部署本地大模型吗?玩玩Hermes应该跑35b。8g显存绝对够了。token应该26每秒以上
-
求指导:谁快来把我打醒买苹果吧。不想玩了跌价不会太大。A卡这显存也不快,感觉不划算。
-
更新一下近况,再请教一下懂Qwen 3.6 35B A3B的3090卡友35b显然开256k。8g显存我都开256k
-
AMD 780M小主机,64G内存跑Qwen 3.6 35B,需要优化建议。这种情况我建议跑benchmark。另外,建议接Codex cli自动分析。