跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
  • LCZ-Black
折叠
品牌标识

抡锤者

首页 版块 标签 硬件 AI 广场
  1. 主页
  2. 版块
  3. LLM讨论区
  4. Qwen3.8-27B 关掉推理~效率快太多 成果差不多

Qwen3.8-27B 关掉推理~效率快太多 成果差不多

已定时 已固定 已锁定 已移动 LLM讨论区
qwen-27b
13 帖子 10 发布者 574 浏览 1 关注中
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • kop wangK kop wang

    https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning

    这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。
    46c48de9-9f43-4587-b648-fb132bca9017-image.jpeg

    Botio KuoB 离线
    Botio KuoB 离线
    Botio Kuo
    德高望重
    编写于 最后由 Botio Kuo 编辑
    #3

    @kop-wang 是的,但我现在实作的过程中,我不觉得那个分数值得更多的时间。。。 效果真的差不多,这MODEL 思考时间真的太长了。。。

    1 条回复 最后回复
    1
    • David ChenD 离线
      David ChenD 离线
      David Chen
      编写于 最后由 编辑
      #4

      所以low是甜蜜點啊....low -> non 可以節省多少時間?

      1 条回复 最后回复
      0
      • N 离线
        N 离线
        neo
        德高望重 劳动模范
        编写于 最后由 编辑
        #5

        关掉推理,连一些基本的测试题都过不了的,稍微复杂点的工具调用也会出错。

        Botio KuoB 1 条回复 最后回复
        0
        • N neo

          关掉推理,连一些基本的测试题都过不了的,稍微复杂点的工具调用也会出错。

          Botio KuoB 离线
          Botio KuoB 离线
          Botio Kuo
          德高望重
          编写于 最后由 Botio Kuo 编辑
          #6

          @neo 有一说一 还是要看你拿来的用途 跟 搭配的 harness , 差异确实不小。。。workflow 跟 一些边界没写好,推理再久还是错

          1 条回复 最后回复
          0
          • kop wangK kop wang

            https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning

            这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。
            46c48de9-9f43-4587-b648-fb132bca9017-image.jpeg

            kos orK 离线
            kos orK 离线
            kos or
            超凡大师
            编写于 最后由 编辑
            #7

            @kop-wang

            沒想到medium and low 只差距一個點

            df7d584e-3f0e-4dc3-a1bb-bbf389259955-image.jpeg

            1 条回复 最后回复
            1
            • terryT 离线
              terryT 离线
              terry
              超级版主
              编写于 最后由 编辑
              #8

              关于推理,我可以负责任地说,如果你使用DSH,在编程等日常任务中,没啥差距,最起码我什么推理等级都使用过,开了推理除了增加一堆输出,毫无卵用。直接裸模型输出,把harness交给dsh去做。

              油管:https://www.youtube.com/@抡锤者

              Botio KuoB 1 条回复 最后回复
              1
              • terryT terry

                关于推理,我可以负责任地说,如果你使用DSH,在编程等日常任务中,没啥差距,最起码我什么推理等级都使用过,开了推理除了增加一堆输出,毫无卵用。直接裸模型输出,把harness交给dsh去做。

                Botio KuoB 离线
                Botio KuoB 离线
                Botio Kuo
                德高望重
                编写于 最后由 编辑
                #9

                @terry 是的,现在已经走 less is more 的路线了, skill 太多 废话太多 都是负担, 现在越聪明的MODEL 越不需要太多额外的提示词,只要给明确的目标,途中不要走歪就好,一开始MAP的路线非常重要,现在个人训练出的 harness 是让自己更好用,所以插件类型的 harness 才会更受欢迎,AI方向一直在变,新的MODEL 最好就不要套用旧版的SKILL跟负担,后面需要在慢慢增加就好,省钱又省时间

                1 条回复 最后回复
                0
                • stxpnetS 离线
                  stxpnetS 离线
                  stxpnet
                  超凡大师
                  编写于 最后由 编辑
                  #10

                  看工作场景吧,编程,还有对账,涉及资金之内的,不差时间我都开最大思考

                  26-08-19
                  双卡3090(8x8x无nvlink,p2p驱动) +Sglang+qwen 3.8 27B awq模型 [功耗异常弃用]
                  8-20 用vllm 0.26+ Qwen3.8-27B-SmoothQuant-W8A8-INT8 200K上下文 ~50t/s

                  1 条回复 最后回复
                  0
                  • dardeaw fengD 离线
                    dardeaw fengD 离线
                    dardeaw feng
                    编写于 最后由 编辑
                    #11

                    留給機器思考,浪費時間,也不可能做到零錯誤
                    不如快點生出來快點測,早點發現問題繼續罵他個祖宗十八代
                    就跟圍棋下快棋一樣,高手落子快還是高手,資質不足給他再多時間依舊廢物

                    1 条回复 最后回复
                    0
                    • paul houP 离线
                      paul houP 离线
                      paul hou
                      编写于 最后由 编辑
                      #12

                      使用這個 https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates
                      再設在low 或 medium的效果還不錯。

                      1 条回复 最后回复
                      0
                      • imbiplaza ASUSI 离线
                        imbiplaza ASUSI 离线
                        imbiplaza ASUS
                        至尊王者
                        编写于 最后由 编辑
                        #13

                        qwen3.8 把thinking 弄成这样乱78糟肯定有他的用处,我关了影响不大,又开回了。。
                        最近更新了我认为好用的nvfp4无审查版本,只是开动q8 kv & 152000k, 还没到oom 又有速度 (75ts),prefill 2800ts 我就不大爱管他,我使用我自己的自制api, loading model 后就开始跑,不大会thinking,然而使用dsh 就会thinking 来thinking 去老半天。。。还没捣鼓原理在哪

                        https://lcz.me/project/dcs

                        1 条回复 最后回复
                        0

                        你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

                        厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

                        有了你的建议,这篇帖子会更精彩哦 💗

                        注册 登录
                        回复
                        • 在新帖中回复
                        登录后回复
                        • 从旧到新
                        • 从新到旧
                        • 最多赞同


                        • 登录

                        • 登录或注册以进行搜索。
                        • 第一个帖子
                          最后一个帖子
                        0
                        • 版块
                        • 最新
                        • 标签
                        • 热门
                        • 用户
                        • 群组