跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. LLM讨论区
  4. Qwen3.8-27B 关掉推理~效率快太多 成果差不多

Qwen3.8-27B 关掉推理~效率快太多 成果差不多

已定时 已固定 已锁定 已移动 LLM讨论区
qwen-27b
13 帖子 10 发布者 574 浏览 1 关注中
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • Botio KuoB 离线
    Botio KuoB 离线
    Botio Kuo
    德高望重
    编写于 最后由 Botio Kuo 编辑
    #1

    推理真的没你想像中的有用 至少在我使用的过程中制造不少问题

    使用的 syv-ai/qwen38-27b-rtx3090, 单卡3090长上下文 240k 设置, 不是在 VLLM 设定关闭推理

    而是在 omp agent harness 上关闭推理 直接设定 off, coding 部分成果差不多 該錯還是會錯,但省下的時間跟上下文真的太多!
    我测试的这专案也不单纯,是在原生开源的基础上新增 herdr 的对接 跟 灯光效果设定,在硬体测试上至少错了五次(但这是AI本身就没办法克服的硬件韧体测试,一定要有人类观察结果反餽),所以结论建议:性子急的可以关掉推理了! 真的快太多!

    测试专案 repo:https://github.com/botio/duckyPad-herdr/

    1 条回复 最后回复
    1
    • kop wangK 离线
      kop wangK 离线
      kop wang
      超级版主
      编写于 最后由 编辑
      #2

      https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning

      这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。
      46c48de9-9f43-4587-b648-fb132bca9017-image.jpeg

      虚心交流,一起进步

      Botio KuoB kos orK 2 条回复 最后回复
      1
      • kop wangK kop wang

        https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning

        这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。
        46c48de9-9f43-4587-b648-fb132bca9017-image.jpeg

        Botio KuoB 离线
        Botio KuoB 离线
        Botio Kuo
        德高望重
        编写于 最后由 Botio Kuo 编辑
        #3

        @kop-wang 是的,但我现在实作的过程中,我不觉得那个分数值得更多的时间。。。 效果真的差不多,这MODEL 思考时间真的太长了。。。

        1 条回复 最后回复
        1
        • David ChenD 离线
          David ChenD 离线
          David Chen
          编写于 最后由 编辑
          #4

          所以low是甜蜜點啊....low -> non 可以節省多少時間?

          1 条回复 最后回复
          0
          • N 离线
            N 离线
            neo
            德高望重 劳动模范
            编写于 最后由 编辑
            #5

            关掉推理,连一些基本的测试题都过不了的,稍微复杂点的工具调用也会出错。

            Botio KuoB 1 条回复 最后回复
            0
            • N neo

              关掉推理,连一些基本的测试题都过不了的,稍微复杂点的工具调用也会出错。

              Botio KuoB 离线
              Botio KuoB 离线
              Botio Kuo
              德高望重
              编写于 最后由 Botio Kuo 编辑
              #6

              @neo 有一说一 还是要看你拿来的用途 跟 搭配的 harness , 差异确实不小。。。workflow 跟 一些边界没写好,推理再久还是错

              1 条回复 最后回复
              0
              • kop wangK kop wang

                https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning

                这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。
                46c48de9-9f43-4587-b648-fb132bca9017-image.jpeg

                kos orK 离线
                kos orK 离线
                kos or
                超凡大师
                编写于 最后由 编辑
                #7

                @kop-wang

                沒想到medium and low 只差距一個點

                df7d584e-3f0e-4dc3-a1bb-bbf389259955-image.jpeg

                1 条回复 最后回复
                1
                • terryT 离线
                  terryT 离线
                  terry
                  超级版主
                  编写于 最后由 编辑
                  #8

                  关于推理,我可以负责任地说,如果你使用DSH,在编程等日常任务中,没啥差距,最起码我什么推理等级都使用过,开了推理除了增加一堆输出,毫无卵用。直接裸模型输出,把harness交给dsh去做。

                  油管:https://www.youtube.com/@抡锤者

                  Botio KuoB 1 条回复 最后回复
                  1
                  • terryT terry

                    关于推理,我可以负责任地说,如果你使用DSH,在编程等日常任务中,没啥差距,最起码我什么推理等级都使用过,开了推理除了增加一堆输出,毫无卵用。直接裸模型输出,把harness交给dsh去做。

                    Botio KuoB 离线
                    Botio KuoB 离线
                    Botio Kuo
                    德高望重
                    编写于 最后由 编辑
                    #9

                    @terry 是的,现在已经走 less is more 的路线了, skill 太多 废话太多 都是负担, 现在越聪明的MODEL 越不需要太多额外的提示词,只要给明确的目标,途中不要走歪就好,一开始MAP的路线非常重要,现在个人训练出的 harness 是让自己更好用,所以插件类型的 harness 才会更受欢迎,AI方向一直在变,新的MODEL 最好就不要套用旧版的SKILL跟负担,后面需要在慢慢增加就好,省钱又省时间

                    1 条回复 最后回复
                    0
                    • stxpnetS 离线
                      stxpnetS 离线
                      stxpnet
                      超凡大师
                      编写于 最后由 编辑
                      #10

                      看工作场景吧,编程,还有对账,涉及资金之内的,不差时间我都开最大思考

                      26-08-19
                      双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
                      8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

                      1 条回复 最后回复
                      0
                      • dardeaw fengD 离线
                        dardeaw fengD 离线
                        dardeaw feng
                        编写于 最后由 编辑
                        #11

                        留給機器思考,浪費時間,也不可能做到零錯誤
                        不如快點生出來快點測,早點發現問題繼續罵他個祖宗十八代
                        就跟圍棋下快棋一樣,高手落子快還是高手,資質不足給他再多時間依舊廢物

                        1 条回复 最后回复
                        0
                        • paul houP 离线
                          paul houP 离线
                          paul hou
                          编写于 最后由 编辑
                          #12

                          使用這個 https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates
                          再設在low 或 medium的效果還不錯。

                          1 条回复 最后回复
                          0
                          • imbiplaza ASUSI 离线
                            imbiplaza ASUSI 离线
                            imbiplaza ASUS
                            至尊王者
                            编写于 最后由 编辑
                            #13

                            qwen3.8 把thinking 弄成这样乱78糟肯定有他的用处,我关了影响不大,又开回了。。
                            最近更新了我认为好用的nvfp4无审查版本,只是开动q8 kv & 152000k, 还没到oom 又有速度 (75ts),prefill 2800ts 我就不大爱管他,我使用我自己的自制api, loading model 后就开始跑,不大会thinking,然而使用dsh 就会thinking 来thinking 去老半天。。。还没捣鼓原理在哪

                            https://lcz.me/project/dcs

                            1 条回复 最后回复
                            0

                            你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                            厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                            有了你的建议,这篇帖子会更精彩哦 💗

                            注册 登录
                            回复
                            • 在新帖中回复
                            登录后回复
                            • 从旧到新
                            • 从新到旧
                            • 最多赞同


                            • 登录

                            • 登录或注册以进行搜索。
                            • 第一个帖子
                              最后一个帖子
                            0
                            • 版块
                            • 最新
                            • 标签
                            • 热门
                            • 用户
                            • 群组