Qwen3.8-27B 关掉推理~效率快太多 成果差不多
-
推理真的没你想像中的有用 至少在我使用的过程中制造不少问题
使用的 syv-ai/qwen38-27b-rtx3090, 单卡3090长上下文 240k 设置, 不是在 VLLM 设定关闭推理
而是在 omp agent harness 上关闭推理 直接设定 off, coding 部分成果差不多 該錯還是會錯,但省下的時間跟上下文真的太多!
我测试的这专案也不单纯,是在原生开源的基础上新增 herdr 的对接 跟 灯光效果设定,在硬体测试上至少错了五次(但这是AI本身就没办法克服的硬件韧体测试,一定要有人类观察结果反餽),所以结论建议:性子急的可以关掉推理了! 真的快太多!测试专案 repo:https://github.com/botio/duckyPad-herdr/
-
https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning
这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。

-
所以low是甜蜜點啊....low -> non 可以節省多少時間?
-
https://artificialanalysis.ai/models/qwen3-8-27b-non-reasoning
这是qwen3.8-27B的关闭思考评测。能力下降的还是比较厉害的。

-
关于推理,我可以负责任地说,如果你使用DSH,在编程等日常任务中,没啥差距,最起码我什么推理等级都使用过,开了推理除了增加一堆输出,毫无卵用。直接裸模型输出,把harness交给dsh去做。
-
留給機器思考,浪費時間,也不可能做到零錯誤
不如快點生出來快點測,早點發現問題繼續罵他個祖宗十八代
就跟圍棋下快棋一樣,高手落子快還是高手,資質不足給他再多時間依舊廢物 -
使用這個 https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates
再設在low 或 medium的效果還不錯。 -
qwen3.8 把thinking 弄成这样乱78糟肯定有他的用处,我关了影响不大,又开回了。。
最近更新了我认为好用的nvfp4无审查版本,只是开动q8 kv & 152000k, 还没到oom 又有速度 (75ts),prefill 2800ts 我就不大爱管他,我使用我自己的自制api, loading model 后就开始跑,不大会thinking,然而使用dsh 就会thinking 来thinking 去老半天。。。还没捣鼓原理在哪
