跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

  1. 主页
  2. 版块
  3. 随便聊聊
  4. 这是qwen3.8的特色吗? 一个简单问题也要疯狂思考几轮

这是qwen3.8的特色吗? 一个简单问题也要疯狂思考几轮

已定时 已固定 已锁定 已移动 随便聊聊
qwen-27b
9 帖子 7 发布者 199 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • stxpnetS 在线
    stxpnetS 在线
    stxpnet
    超凡大师
    编写于 最后由 stxpnet 编辑
    #1

    用的是v22的聊天模板,同时也关了思考:
    24dfcfc5-97c0-43f2-b66d-9c8f98ca8565-image.jpeg
    622585bc-f7d9-4f52-bbf5-350526ab9036-image.jpeg

    选择最小思考,似乎能缓解:
    0cf00e52-59dd-4a8c-b458-ac0655bdfd1e-image.jpeg

    复杂一点的问题,似乎又在过度思考了:
    1b67b578-8b0b-4da9-9752-bcf928b26e58-image.jpeg
    真正的实际问题,没有之前我的QWEN 3.6 35B A3B快,但是已经很满意 了,除了这个又臭又长的思考,这种用网页查找的任务不是编程,根本不需要它思考。

    26-08-19
    双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
    8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

    1 条回复 最后回复
    1
    • C 离线
      C 离线
      Che
      编写于 最后由 编辑
      #2

      超绝大思考。。知道的以为它在干活,不知道的还以为它似了呢

      1 条回复 最后回复
      0
      • terryT 在线
        terryT 在线
        terry
        超级版主
        编写于 最后由 编辑
        #3

        哥,35B A3B需求的算力和带宽小多了,它当然快了。当然这个模型确实爱思考。

        油管:https://www.youtube.com/@抡锤者

        1 条回复 最后回复
        0
        • kos orK 在线
          kos orK 在线
          kos or
          技术大牛 劳动模范
          编写于 最后由 编辑
          #4

          請問這是什麼介面 還能這樣彈性選擇

          7859181b-8913-467d-88d9-4cbced33f038-image.jpeg

          stxpnetS 1 条回复 最后回复
          0
          • kos orK kos or

            請問這是什麼介面 還能這樣彈性選擇

            7859181b-8913-467d-88d9-4cbced33f038-image.jpeg

            stxpnetS 在线
            stxpnetS 在线
            stxpnet
            超凡大师
            编写于 最后由 编辑
            #5

            @kos-or hermes的聊天界面。这是0.19的。

            26-08-19
            双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
            8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

            1 条回复 最后回复
            0
            • David ChenD 在线
              David ChenD 在线
              David Chen
              编写于 最后由 编辑
              #6

              前幾篇不是有分析過設定從 none -> low.... CP值最高

              1 条回复 最后回复
              0
              • R 离线
                R 离线
                rori
                编写于 最后由 编辑
                #7

                你是用llamacpp嗎? 不用思考的話, 啟動參數加上 --reasoning off 就可以

                1 条回复 最后回复
                0
                • 老 离线
                  老 离线
                  老茶
                  编写于 最后由 编辑
                  #8
                  此主題已被删除!
                  1 条回复 最后回复
                  0
                  • terryT 在线
                    terryT 在线
                    terry
                    超级版主
                    编写于 最后由 terry 编辑
                    #9

                    可以关掉了,多找找参数,抄下 @chia-an-yang 的帖子,我测了下,还是他的方案最有性价比。

                    油管:https://www.youtube.com/@抡锤者

                    1 条回复 最后回复
                    0

                    你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                    厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                    有了你的建议,这篇帖子会更精彩哦 💗

                    注册 登录
                    回复
                    • 在新帖中回复
                    登录后回复
                    • 从旧到新
                    • 从新到旧
                    • 最多赞同


                    • 登录

                    • 登录或注册以进行搜索。
                    • 第一个帖子
                      最后一个帖子
                    0
                    • 版块
                    • 最新
                    • 标签
                    • 热门
                    • 用户
                    • 群组