跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

S

sarcoma

@sarcoma
取消关注 关注
关于
帖子
21
主题
0
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • ornith-1.0-35b Q8 與 Qwen3.6-35b-a3b Q8....大家覺的哪個更優秀?
    S sarcoma

    gemma4 26b a4b我觉得还行,哈哈哈,不接agent,直接当个推理模型、IT知识库用

    随便聊聊 qwen-27b 量化

  • 新手不要碰DGX Spark(重要事情说三遍)
    S sarcoma

    @jenaflex 不同意楼主说的395的观点,每个人的需要不太一样吧,我有7900XTX、我有RTX 5060,我也用AI Max 395 128GB,用的挺好,挺合适。可能每个人的需求不同吧。

    随便聊聊 dgxspark gb10

  • 我的搜索自己说了算
    S sarcoma

    sarcoma 说:

    我一直在用searxng,觉得很方便,配合firecrawl

    全本地😊

    LLM讨论区 本地模型

  • 我的搜索自己说了算
    S sarcoma

    我一直在用searxng,觉得很方便,配合firecrawl

    LLM讨论区 本地模型

  • 關於去馬賽克
    S sarcoma

    还能这么玩,小板凳搬好了等着看结果。。。

    随便聊聊

  • PVE HomeLab ( R9700x2+3090) 極限方案
    S sarcoma

    之前也可能是显卡的问题,那会儿想通VEGA 56,🤣,怎么都不行,各种黑屏、各种兼容性报错,什么reset bug,不管windows、ubuntu都不行。弄了好几次,弄的我都残了,后来就有心理阴影了,直通只敢通NVIDIA,方便很多。我现在的7900 XTX只敢跑着裸机Ubuntu,不敢PVE上直通了,虽然很想。

    看着你的帖子,我又重燃斗志,🤣

    AI硬件 rtx3090 r9700

  • AMD AI Max 395 128GB这玩意能不能买……
    S sarcoma

    @gg-lib 我在用Ryzen 395啊。395跑qwen3.6 35b a3b模型给hermes 当基础主模型用,开一些cron定时任务,可以干。主要待机省电。

    我有很多文字处理和RAG的任务要做,专业微调模型、翻译模型、嵌入模型、视觉识别模型都跑在395上,128GB统一内存开GTT的话,VRAM可以用到~122GB。很多模型可以一直加载着,随时可以用。我觉得395适合需要单人的多开模型的场合,当然算力还是有限、没法并行。

    当然395的确不快,尤其是prefill实在是让人着急。hermes-agent正常任务或者长上下文的话我会用另外的7900 XTX跑qwen 27b。

    随便聊聊 amd

  • PVE HomeLab ( R9700x2+3090) 極限方案
    S sarcoma

    学习中,我一直想pve直通AMD卡,之前折腾过好久都不行。

    AI硬件 rtx3090 r9700

  • 请教你们都是怎么解决上下文总是满了的问题?
    S sarcoma

    @mark kv cache放VRAM里就行了啊 放内存慢

    LLM讨论区 本地模型

  • 你们的Hermes都是怎么网上冲浪的?
    S sarcoma

    @williamlouis 我个人的经验的话,还是得看具体的任务难度。我的hermes的默认profile用的qwen3.6 35b a3,负责做一些简单的任务以及控制cron定时任务,够用了。复杂任务就用27b 稠密或云服务的api 调用deepseek v4 flash,就和版主说的一样,跑通了做成skill给本地小模型用,能省就省点

    AI Agent hermes

  • 你们的Hermes都是怎么网上冲浪的?
    S sarcoma

    @九龙杨生 那就只能本地部署或刷卡咯。本地部署得担心爬太多ip被墙了,其他还好。我爬的少,检索咨询为主,问题不大

    AI Agent hermes

  • 你们的Hermes都是怎么网上冲浪的?
    S sarcoma

    每个月firecrawl在线也是送1000条还是500条来着,也可以切换着用

    本地服务么,还得挂哪个啥,也是成本,🤣

    AI Agent hermes

  • 关于 Hermes 干活的, 严!重!警!告!!!
    S sarcoma

    我的本地模型还很自信的帮我修证cron脚本执行错误,然后帮我改了hermes系统架构里的py脚本,然后hermes瘫了!哈哈哈哈,那天一阵忙乱,还好是虚拟机,恢复起来方便。
    我后来在SOUL.md里强制他修改系统框架脚本必须我的approval才行

    AI Agent hermes

  • 你们的Hermes都是怎么网上冲浪的?
    S sarcoma

    我用本地searxng服务配置给hermes的web_search用,简单的信息搜索他回复很快,貌似是meta search的关系。
    深度搜索或需要仔细读取网页内容的时候,hermes会调用我的本地firecrawl服务来读取网页内容。这时候其实分两层,一层是firecrawl爬取网页的速度,还有就是对网页内容进行归纳总结的速度(推理模型的速度),这个可以在config.yaml的服务任务(auxiliary)中设置web_extract部分控制,默认是主模型,但是如果主模型不够快(比如本地小模型),你可以指定其他模型,比如云模型api、或本地更快的模型来执行。

    AI Agent hermes

  • 购买了deepseek的api key无法在hermes中使用
    S sarcoma

    实在不行就用个本地模型(9b这种也够了),让他给你好好试下,总有一个方案能连上,🤣

    AI Agent hermes deepseek

  • 请教你们都是怎么解决上下文总是满了的问题?
    S sarcoma

    @mark 纯GPU推理,需要这么大的RAM么?好奇😯

    LLM讨论区 本地模型

  • 购买了deepseek的api key无法在hermes中使用
    S sarcoma

    你试试看这样,base_url后面加/v1:
    base_url: https://api.siliconflow.cn/v1
    然后provider改成custom

    我用的硅基流动的api,也是会碰到没法连接的问题,然后这么改了就行了。

    model:
      api_key: 我的密码
      base_url: https://api.siliconflow.cn/v1
      context_length: 524288
      default: deepseek-ai/DeepSeek-V4-Flash
      provider: custom
    
    AI Agent hermes deepseek

  • 网络资讯。使用DeepSeek API 服务预计7月中旬开始采用峰谷定价策略
    S sarcoma

    我用硅基流动的api,看着还没涨价

    网络技术 deepseek

  • 硬件又开始涨价了
    S sarcoma

    看着5999的价格,去年年初5400订了台m4 mac mini(加了万兆网卡),现在终于觉得香了。

    水果家已经退烧了,Ryzen 395的小盒子用着安心,虽然和去年比也涨了不少

    AI硬件

  • 我来简单一次说清楚Resizeable BAR吧
    S sarcoma

    我知道这个resizable bar是因为要做虚拟机硬件直通,哈哈哈。不过之前试过在老板子上插两块5060 Ti后面就是遇到resizable bar的问题,死活不认

    AI硬件 resizeablebar x99 bios
  • 登录

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组