<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数]]></title><description><![CDATA[<p dir="auto"><img src="https://upload.lcz.me/uploads/2b3f8ff3-42cf-45b3-80e3-be80d42885c9.png" alt="33333.png" class=" img-fluid img-markdown" /></p>
<h2>Qwen-Fixed-Chat-Templates</h2>
<p dir="auto">看了B站一个视频，引入 jinja chat templates 可以改善一些问题。<br />
我没有深度使用测试,发个帖子，给不知道引入的同学做个参考。</p>
<blockquote>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f3af.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--dart" style="height:23px;width:auto;vertical-align:middle" title="🎯" alt="🎯" />参考<br />
<a href="https://www.bilibili.com/video/BV144bX6iEEM/?share_source=copy_web&amp;vd_source=e247ee4bbb960625f3578586f7d07456" rel="nofollow ugc">【分享】改善Qwen3.8雷霆大思考</a></p>
</blockquote>
<blockquote>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f3af.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--dart" style="height:23px;width:auto;vertical-align:middle" title="🎯" alt="🎯" /> 通过 <a href="https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates" rel="nofollow ugc">froggeric/Qwen-Fixed-Chat-Templates</a> 仓库的 <strong>v22 模板</strong>，设定不同思考模式来解决核心问题。</p>
</blockquote>
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f4e6.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--package" style="height:23px;width:auto;vertical-align:middle" title="📦" alt="📦" /> 仓库内容介绍</h2>
<p dir="auto">这是一个为 Qwen 3.5 / 3.6 / <strong>3.8</strong> 打造的<strong>通用修复版聊天模板</strong>（chat template（聊天模板）= 提示词包装器，Jinja 格式，负责把对话历史 + 工具定义组织成模型能理解的格式）。</p>
<p dir="auto"><strong>解决官方模板的 5 大问题</strong>（官方模板 = 模型发布时自带的原版模板）：</p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th style="text-align:center">#</th>
<th style="text-align:left">修复项</th>
<th style="text-align:left">官方模板的问题 → v22 的修复</th>
</tr>
</thead>
<tbody>
<tr>
<td style="text-align:center">1</td>
<td style="text-align:left"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f39a.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--level_slider" style="height:23px;width:auto;vertical-align:middle" title="🎚" alt="🎚" />️ <strong>思考深度控制</strong> · Reasoning Effort Steering</td>
<td style="text-align:left">官方 3.8 支持思考预算（<code>xhigh</code> 极深 / <code>high</code> 深 / <code>medium</code> 中 / <code>low</code> 浅），v22 默认注入 <code>xhigh</code> 指令，关思考时自动抑制</td>
</tr>
<tr>
<td style="text-align:center">2</td>
<td style="text-align:left"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/26a1.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--zap" style="height:23px;width:auto;vertical-align:middle" title="⚡" alt="⚡" /> <strong>恢复快速模式</strong> · Fast Mode</td>
<td style="text-align:left">官方 3.8 传 <code>enable_thinking=false</code>（关闭思考）会<strong>直接崩溃</strong>！v22 解除此限制，可自由开关思考</td>
</tr>
<tr>
<td style="text-align:center">3</td>
<td style="text-align:left">🧹 <strong>修复空思考污染</strong> · Empty Think Bug</td>
<td style="text-align:left">官方 3.8 多轮对话会插入空 <code>&lt;/think&gt;</code> 块，v22 干净提取思考内容不重复</td>
</tr>
<tr>
<td style="text-align:center">4</td>
<td style="text-align:left"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f527.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--wrench" style="height:23px;width:auto;vertical-align:middle" title="🔧" alt="🔧" /> <strong>通用工具参数</strong> · Universal Tool Arguments</td>
<td style="text-align:left">官方 3.8 收到标准 OpenAI（接口规范）字符串参数会 <strong>TypeError 崩溃</strong>！v22 兼容字典和 JSON 字符串两种格式</td>
</tr>
<tr>
<td style="text-align:center">5</td>
<td style="text-align:left">🦙 <strong>llama.cpp 原生支持</strong></td>
<td style="text-align:left">支持 <code>--reasoning-preserve</code> 参数（保留思考、保证前缀缓存 100% 生效）</td>
</tr>
</tbody>
</table>
<p dir="auto"><strong><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f5a5.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--desktop_computer" style="height:23px;width:auto;vertical-align:middle" title="🖥" alt="🖥" />️ 支持平台</strong>：LM Studio / llama.cpp / vLLM / MLX / KoboldCPP 等一切支持 Hugging Face 模板的引擎。仓库根目录只需一个 <code>chat_template.jinja</code> 文件，适用于所有 Qwen 3.5 / 3.6 / 3.8 模型。</p>
<h2>引入示例</h2>
<pre><code class="language-c">git clone https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates
</code></pre>
<p dir="auto">启动参数:</p>
<pre><code class="language-c">#!/bin/bash
# Qwen3.8-27B 启动脚本 - TurboQuant MTP 版 (200K 上下文, 视觉 + 投机解码)
# 使用 llama-cpp-turboquant-mtp/ (最新 fork fca3093, 支持 draft-mtp)
# 不依赖旧 b9082 build (无法加载 MTP 版 GGUF)

SERVER="./llama-cpp-turboquant-mtp/build/bin/llama-server"
MODEL="./models/Qwen3.8-27B-Q3_K_M.gguf"
MMPROJ="./models/mmproj-BF16.gguf"
PORT=8080

export LD_LIBRARY_PATH="$(cd "$(dirname "$SERVER")" &amp;&amp; pwd):/opt/cuda/lib64:$LD_LIBRARY_PATH"

CPU_THREADS=12
GPU_LAYERS=99
# CONTEXT_SIZE=131072
CONTEXT_SIZE=200000
BATCH_SIZE=512

echo "Starting Qwen3.8-27B (TurboQuant MTP) with 200K context..."
${SERVER} \
  -m "${MODEL}" \
  --mmproj "${MMPROJ}" \
  --chat-template-file ./Qwen-Fixed-Chat-Templates/chat_template.jinja \
  --reasoning-format deepseek \
  --reasoning-preserve \
  -c ${CONTEXT_SIZE} \
  -n -1 \
  -t ${CPU_THREADS} \
  -ngl ${GPU_LAYERS} \
  --parallel 1 \
  --cache-type-k turbo3 \
  --cache-type-v turbo3 \
  --flash-attn on \
  --load-mode mlock \
  --batch-size ${BATCH_SIZE} \
  --ubatch-size 512 \
  --reasoning-budget -1 \
  --spec-type draft-mtp \
  --spec-draft-n-max 3 \
  --spec-draft-p-min 0.75 \
  --host 0.0.0.0 \
  --port ${PORT} \
  --log-disable \
  &amp;
echo "Server started on http://localhost:${PORT}"
echo "MMPROJ vision enabled, MTP speculative decoding enabled"
</code></pre>
<p dir="auto">简单测试结果：</p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/b7f970ad-9c87-4686-8129-2d374373c99e.png" alt="PixPin_2026-08-17_03-48-17.png" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/topic/1151/qwen3.8-27b-引入froggeric-qwen-fixed-chat-templates-fix-思考深度控制-恢复快速模式-修复空思考污染-通用工具参数</link><generator>RSS for Node</generator><lastBuildDate>Sun, 30 Aug 2026 11:36:26 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1151.rss" rel="self" type="application/rss+xml"/><pubDate>Sun, 16 Aug 2026 19:56:19 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Mon, 17 Aug 2026 17:17:18 GMT]]></title><description><![CDATA[<p dir="auto">我的Deepseek-V4-Flash 今天Token額度爆了, 趕快來你這邊上課取經 <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f642.png?v=6e8e1372d58" class="not-responsive emoji emoji-android emoji--slightly_smiling_face" style="height:23px;width:auto;vertical-align:middle" title=":)" alt="🙂" /></p>
]]></description><link>https://lcz.me/post/12598</link><guid isPermaLink="true">https://lcz.me/post/12598</guid><dc:creator><![CDATA[kos or]]></dc:creator><pubDate>Mon, 17 Aug 2026 17:17:18 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Mon, 17 Aug 2026 14:36:10 GMT]]></title><description><![CDATA[<p dir="auto">謝謝分享，現在 Qwen3.8 能用了，沒加之前3行 Powershell 想了半個小時...</p>
]]></description><link>https://lcz.me/post/12552</link><guid isPermaLink="true">https://lcz.me/post/12552</guid><dc:creator><![CDATA[Arthur]]></dc:creator><pubDate>Mon, 17 Aug 2026 14:36:10 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Mon, 17 Aug 2026 10:28:03 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/stxpnet" aria-label="Profile: stxpnet">@<bdi>stxpnet</bdi></a> <a href="/post/12440">说</a>:</p>
<p dir="auto">我的满载73度。 你的如果是linux可以试试用coolercontorld，把风扇转速拉高点，让它空载时候的起始温度低一些，或许有帮助</p>
</blockquote>
<p dir="auto">感謝，我看我的風扇吹的挺積極的80度基本都能維持 90%以上的轉速</p>
]]></description><link>https://lcz.me/post/12509</link><guid isPermaLink="true">https://lcz.me/post/12509</guid><dc:creator><![CDATA[像素盒子]]></dc:creator><pubDate>Mon, 17 Aug 2026 10:28:03 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Mon, 17 Aug 2026 10:17:53 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/2024fatwolf55" aria-label="Profile: 2024fatwolf55">@<bdi>2024fatwolf55</bdi></a> 居然有人比我更狠 我限制245w</p>
]]></description><link>https://lcz.me/post/12506</link><guid isPermaLink="true">https://lcz.me/post/12506</guid><dc:creator><![CDATA[applejuice]]></dc:creator><pubDate>Mon, 17 Aug 2026 10:17:53 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Mon, 17 Aug 2026 06:46:47 GMT]]></title><description><![CDATA[<p dir="auto">我使用功耗墙限制180W，加外置机箱风扇以最高转速对着显卡吹，夏天的地下室，无空调，室温32度左右。能基本上压制在85以下。让Hermes Agent在Ubuntu系统中写了一个服务器端监控脚本，持续监控GPU核心温度。我这里设定是持续超过85度3分钟以上就自动关机了。</p>
]]></description><link>https://lcz.me/post/12474</link><guid isPermaLink="true">https://lcz.me/post/12474</guid><dc:creator><![CDATA[2024fatwolf55]]></dc:creator><pubDate>Mon, 17 Aug 2026 06:46:47 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Mon, 17 Aug 2026 00:21:00 GMT]]></title><description><![CDATA[<p dir="auto">我的满载73度。 你的如果是linux可以试试用coolercontorld，把风扇转速拉高点，让它空载时候的起始温度低一些，或许有帮助</p>
]]></description><link>https://lcz.me/post/12440</link><guid isPermaLink="true">https://lcz.me/post/12440</guid><dc:creator><![CDATA[stxpnet]]></dc:creator><pubDate>Mon, 17 Aug 2026 00:21:00 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Sun, 16 Aug 2026 22:11:56 GMT]]></title><description><![CDATA[<p dir="auto">二手 3090 满载 85℃，先别急着拆，给你一个能落地的判断标准：</p>
<p dir="auto">先分清是哪个温度在 85℃：</p>
<ul>
<li>核心（GPU 芯片）：3090 默认温度墙就是 83℃，满载 80-85 是正常区间，90℃ 以上才需要紧张</li>
<li>显存结温（GDDR6X）：这才是二手 3090 的重点。GDDR6X 天生巨热，满载结温 95-105℃ 都很常见，但长期 105℃+ 会加速显存老化</li>
</ul>
<p dir="auto">判断方法：跑 10 分钟满载负载（跑模型推理就行），用 HWiNFO 看 "GPU Memory Junction Temperature"（Windows）或者 GPU-Z 的显存温度：</p>
<ul>
<li>核心 &lt;85℃ 且 显存结温 &lt;100℃：不用动，正常用</li>
<li>显存结温 100-105℃：建议换硅脂+导热垫，换完通常能降 10-20℃</li>
<li>显存结温 105℃+：必须处理，不然显存寿命肉眼可见地缩短</li>
</ul>
<p dir="auto">二手卡为什么普遍建议到手就换：前主人可能是矿卡，硅脂早就干透了、导热垫被压扁失去弹性，换完之后核心降 10℃+ 是常态，风扇噪音也跟着小一大截。</p>
<p dir="auto">怕拆坏的话给你几个保命要点：</p>
<ul>
<li>3090 拆解本身不难，真正的难点是导热垫厚度——不同型号混用 1.5mm/2mm/3mm，买之前先搜你自己这个型号的拆解帖，照着厚度买</li>
<li>核心换相变片（PTM7950）比硅脂省心，不用涂、寿命长；导热垫买对应厚度的，别买厚了导致核心接触不良</li>
<li>螺丝对角顺序拧，别一次拧死；显存供电区的排线轻拔</li>
<li>实在不敢拆：先清灰 + 检查风扇转速曲线 + 机箱风道，能压个 2-5℃；但硅脂老化是物理问题，治标不治本</li>
</ul>
<p dir="auto">一句话总结：85℃ 本身不是红线，先看显存结温再决定拆不拆；二手卡换硅脂属于"到手就该做"的常规保养，比显卡真出问题再修便宜太多了。</p>
]]></description><link>https://lcz.me/post/12436</link><guid isPermaLink="true">https://lcz.me/post/12436</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Sun, 16 Aug 2026 22:11:56 GMT</pubDate></item><item><title><![CDATA[Reply to Qwen3.8-27B 引入froggeric/Qwen-Fixed-Chat-Templates Fix: 思考深度控制，恢复快速模式，修复空思考污染，通用工具参数 on Sun, 16 Aug 2026 20:29:59 GMT]]></title><description><![CDATA[<p dir="auto">另外问一下大家，我买的二手3090，跑模型最高能跑到85℃，用不用更换硅脂，换硅胶散热什么的，一直懒得弄，怕给它拆坏了<br />
<img src="https://upload.lcz.me/uploads/077a4739-9d44-4496-9877-37560d84eaf3.png" alt="PixPin_2026-08-17_04-26-46.png" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/post/12435</link><guid isPermaLink="true">https://lcz.me/post/12435</guid><dc:creator><![CDATA[像素盒子]]></dc:creator><pubDate>Sun, 16 Aug 2026 20:29:59 GMT</pubDate></item></channel></rss>