<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[开源个安装包Qwen3.6 35B 塞进了 8GB 显存笔记本：128K、多模态、Thinking，一键安装还能接本地 Agent]]></title><description><![CDATA[<p dir="auto">抡锤的大家都不是小白 就不废话了<br />
<img src="https://upload.lcz.me/uploads/2389ad9c-36fc-4d43-9c5c-549dc42b0011.png" alt="a67eb58469e211990b8051e156a13f2c.png" class=" img-fluid img-markdown" /><br />
<img src="https://upload.lcz.me/uploads/035e61f6-c3f1-42d8-a8ea-21c7322a80f8.png" alt="035deaab339dda47638ee187ab6c11d4.png" class=" img-fluid img-markdown" /><br />
真机演示视频（实际速度）在：<a href="https://live.csdn.net/v/539144?spm=1001.2014.3001.5501" rel="nofollow ugc">https://live.csdn.net/v/539144?spm=1001.2014.3001.5501</a><br />
我自己的电脑配置：</p>
<ul>
<li>RTX 4070 Laptop，8GB 显存</li>
<li>Intel i7-14650HX</li>
<li>32GB 内存</li>
<li>Windows 11<br />
模型是 Qwen3.6-35B-A3B 的 Q4_K_M GGUF 版本，使用官方 llama.cpp CUDA 后端。</li>
</ul>
<p dir="auto">现在的版本就是完整 35B 模型直接工作。</p>
<ul>
<li>
<p dir="auto">短文本生成约 42.3 token/s</p>
</li>
<li>
<p dir="auto">Thinking 模式约 42.1 token/s<br />
我把运行需要的东西都装进包里了：</p>
</li>
<li>
<p dir="auto">llama.cpp b10355</p>
</li>
<li>
<p dir="auto">CUDA 12.4 runtime</p>
</li>
<li>
<p dir="auto">cuBLAS</p>
</li>
<li>
<p dir="auto">GGML CPU/CUDA 后端</p>
</li>
<li>
<p dir="auto">Microsoft VC++ 应用本地运行库</p>
</li>
<li>
<p dir="auto">FFmpeg 和 FFprobe</p>
</li>
<li>
<p dir="auto">完整模型与多模态 projector</p>
</li>
<li>
<p dir="auto">本地对话 UI<br />
目标电脑不需要再安装 Python、Node.js、CUDA Toolkit、Visual Studio 或 VC++ Redistributable。</p>
</li>
</ul>
<p dir="auto">只需要 Windows 10/11、兼容的 NVIDIA 驱动、8GB 级显存和 32GB 内存。</p>
<p dir="auto">安装过程就是：</p>
<ol>
<li>使用密码 <code>123</code> 解压安装包。</li>
<li>双击 <code>INSTALL_QWEN35B.bat</code>。</li>
<li>等待模型校验和加载。</li>
<li>浏览器自动打开后输入密码 <code>123</code>。</li>
</ol>
<p dir="auto">桌面会自动生成启动、停止和打开对话的快捷方式<br />
UI 可以直接添加：</p>
<ul>
<li>图片</li>
<li>视频</li>
<li>文本文件</li>
</ul>
<p dir="auto">我实际测试了发票 OCR、图表读取、一般图片问答和视频画面识别。</p>
<p dir="auto">例如图表测试能够正确返回 <code>BETA, 7</code>，视频测试能够识别出画面中的验证码 <code>8642</code>。视频处理使用包内 FFmpeg，不需要用户另外配置。</p>
<p dir="auto">当前 projector 不支持音频。PDF 和 Office 二进制文件也没有在浏览器端强行乱解析，建议转换成文本或页面图片后再上传。</p>
<p dir="auto"><strong>Thinking 可以开，也可以关</strong></p>
<p dir="auto">UI 可以选择：</p>
<ul>
<li>自动</li>
<li>8K</li>
<li>16K</li>
<li>32K</li>
<li>64K</li>
<li>128K</li>
</ul>
<p dir="auto">默认建议使用“自动”。短对话不会每次都背着 128K 历史跑，随着会话增长再逐步扩大预算。</p>
<p dir="auto"><strong>可以直接接自己的本地 Agent</strong></p>
<p dir="auto">服务提供 OpenAI 兼容接口：</p>
<pre><code>Base URL: http://127.0.0.1:8090/v1
API key: 123
Model: qwen35b-local
</code></pre>
<p dir="auto">百度网盘：</p>
<p dir="auto"><a href="https://pan.baidu.com/s/1ff1XmuJTeb_TZa2Q9vVEfw?pwd=auj7" rel="nofollow ugc">https://pan.baidu.com/s/1ff1XmuJTeb_TZa2Q9vVEfw?pwd=auj7</a></p>
<p dir="auto">提取码：auj7</p>
<p dir="auto">完整安装包解压密码：123</p>
<p dir="auto">UI 登录密码/API Key：123</p>
<p dir="auto">安装包约 21.82 GiB，请确认磁盘空间，并务必完整解压后再运行安装程序。</p>
]]></description><link>https://lcz.me/topic/1080</link><generator>RSS for Node</generator><lastBuildDate>Thu, 10 Sep 2026 03:36:04 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1080.rss" rel="self" type="application/rss+xml"/><pubDate>Tue, 11 Aug 2026 06:37:31 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 开源个安装包Qwen3.6 35B 塞进了 8GB 显存笔记本：128K、多模态、Thinking，一键安装还能接本地 Agent on Wed, 12 Aug 2026 05:24:53 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/stxpnet" aria-label="Profile: stxpnet">@<bdi>stxpnet</bdi></a> 例如图表测试能够正确返回 <code>BETA, 7</code>，视频测试能够识别出画面中的验证码 <code>8642</code> 你说的实际问题还想问啥 我自己跑下给你结果就行 不麻烦<br />
上下文方面<br />
| 实际提示长度 | 验证位置 | 结果 | 预填充速度 |<br />
| 32,748 token | 50% | 通过 | 356.1 token/s |<br />
| 65,544 token | 8%、91% | 通过 | 350.1 token/s |<br />
| 119,998 token | 4%、50%、96% | 通过 | 346.2 token/s |<br />
速度反正能用  不吹玄学：120K 提示在测试机上预填充约 346.6 秒。128K 是需要的时候真能用，但是长上下文肯定没有那么流畅。不过咱们自己用不需要那么长吧，我自己上下文都是通过agent挂rag或者路由知识网解决。</p>
]]></description><link>https://lcz.me/post/11951</link><guid isPermaLink="true">https://lcz.me/post/11951</guid><dc:creator><![CDATA[bingqin wang]]></dc:creator><pubDate>Wed, 12 Aug 2026 05:24:53 GMT</pubDate></item><item><title><![CDATA[Reply to 开源个安装包Qwen3.6 35B 塞进了 8GB 显存笔记本：128K、多模态、Thinking，一键安装还能接本地 Agent on Wed, 12 Aug 2026 04:36:55 GMT]]></title><description><![CDATA[<p dir="auto">想看解决实际问题，上下文超过60K之后的实际数据。</p>
]]></description><link>https://lcz.me/post/11949</link><guid isPermaLink="true">https://lcz.me/post/11949</guid><dc:creator><![CDATA[stxpnet]]></dc:creator><pubDate>Wed, 12 Aug 2026 04:36:55 GMT</pubDate></item><item><title><![CDATA[Reply to 开源个安装包Qwen3.6 35B 塞进了 8GB 显存笔记本：128K、多模态、Thinking，一键安装还能接本地 Agent on Wed, 12 Aug 2026 04:16:11 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/williamlouis" aria-label="Profile: williamlouis">@<bdi>williamlouis</bdi></a> 必须落实</p>
]]></description><link>https://lcz.me/post/11944</link><guid isPermaLink="true">https://lcz.me/post/11944</guid><dc:creator><![CDATA[bingqin wang]]></dc:creator><pubDate>Wed, 12 Aug 2026 04:16:11 GMT</pubDate></item><item><title><![CDATA[Reply to 开源个安装包Qwen3.6 35B 塞进了 8GB 显存笔记本：128K、多模态、Thinking，一键安装还能接本地 Agent on Tue, 11 Aug 2026 14:51:27 GMT]]></title><description><![CDATA[<p dir="auto">上点图。兄弟。界面截图就行</p>
]]></description><link>https://lcz.me/post/11900</link><guid isPermaLink="true">https://lcz.me/post/11900</guid><dc:creator><![CDATA[williamlouis]]></dc:creator><pubDate>Tue, 11 Aug 2026 14:51:27 GMT</pubDate></item></channel></rss>