跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. AI Agent
  4. hermes 应用案例 让它上网搜索一些 llama.cpp的LINUX GUI

hermes 应用案例 让它上网搜索一些 llama.cpp的LINUX GUI

已定时 已固定 已锁定 已移动 AI Agent
llama.cpphermeslinux
3 帖子 3 发布者 286 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • stxpnetS 离线
    stxpnetS 离线
    stxpnet
    超凡大师
    发表于 最后由 stxpnet 编辑
    #1

    结果:
    a82fe5bc-68d5-436b-b947-f27bd1ade4e8-image.jpeg

    用的RTX3090+QWEN 3.6 27B驱动,消耗70K token。
    结束时速度为50T/S左右。
    长文本使用另一台P100 16G的GPU QWEN 9B驱动。

    07488e0c-40ec-4491-afd8-b128b89b551d-image.jpeg

    使用SKILL: cloakbrowser , cloakmanager.
    主要目标网站 ,谷歌,reddit

    26-08-19
    双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
    8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

    1 条回复 最后回复
    2
    • terryT terry 于 将此主题从 随便聊聊 移至此处
    • terryT 离线
      terryT 离线
      terry
      超级版主
      发表于 最后由 编辑
      #2

      不错的小实验,整个过程体感如何,是不是很慢。

      油管:https://www.youtube.com/@抡锤者

      1 条回复 最后回复
      0
      • M 离线
        M 离线
        mark
        超凡大师
        发表于 最后由 编辑
        #3

        先点赞, 再看看贴子, 是一个不错的尝试.

        1 条回复 最后回复
        0

        你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

        厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

        有了你的建议,这篇帖子会更精彩哦 💗

        注册 登录
        回复
        • 在新帖中回复
        登录后回复
        • 从旧到新
        • 从新到旧
        • 最多赞同


        • 登录

        • 登录或注册以进行搜索。
        • 第一个帖子
          最后一个帖子
        0
        • 版块
        • 最新
        • 标签
        • 热门
        • 用户
        • 群组