<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[请教一下大家deepseek v4 flash驱动hermes都开推理吗？]]></title><description><![CDATA[<p dir="auto">我昨天让hermes帮我解决一个invidisou本地部署的问题，结果deepseek 思考的tokens远大于它写结论的tokens一下午用了15元，感觉思考过度呢？<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f236.png?v=138704eccfe" class="not-responsive emoji emoji-android emoji--u6709" style="height:23px;width:auto;vertical-align:middle" title="🈶" alt="🈶" />️一次思考了有一分半。大家有遇到类似的问题吗？还是我的使用方式有问题？还有本地模型，比如27b dense 和35b moe大家都开思考吗？谢谢！</p>
]]></description><link>https://lcz.me/topic/1006/请教一下大家deepseek-v4-flash驱动hermes都开推理吗</link><generator>RSS for Node</generator><lastBuildDate>Tue, 11 Aug 2026 14:53:04 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1006.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 03 Aug 2026 01:23:19 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Tue, 04 Aug 2026 23:17:08 GMT]]></title><description><![CDATA[<p dir="auto">我用的 hermes 默认设置, 没想过这个, 刚让TA自己查了, 开的是 中</p>
<p dir="auto">agent.reasoning_effort<br />
• 值: medium (第36行)<br />
• 含义: 推理努力度设为中等 → 全局开启推理</p>
<p dir="auto">show_reasoning<br />
• 值: false (第283行)<br />
• 含义: 推理内容隐藏，不显示在回复里</p>
<p dir="auto">我的使用体验是, 你描述 需求/问题 越精确, agent 工作得越快, 费的token越少.</p>
<p dir="auto">至于你说的这个问题, 你说最终原因是 "手机浏览器支持mp4，不支持另一个协议" 那么你的 agent 还去操作手机测试了? 这个操作手机的过程比较费token吧? 我猜.</p>
]]></description><link>https://lcz.me/post/11439</link><guid isPermaLink="true">https://lcz.me/post/11439</guid><dc:creator><![CDATA[crazypeace]]></dc:creator><pubDate>Tue, 04 Aug 2026 23:17:08 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 07:17:21 GMT]]></title><description><![CDATA[<p dir="auto">nami-ryuu 你这个观察很准：成本高通常不是"思考"本身，而是探索轮数。Hermes 面对模糊任务会主动扩大搜索面（你看到的暴力搜索），每多试探一轮就要多吃一轮 prefill 加输出，费用就叠上去了。你总结的"人先缩小搜索空间"正是最有效的杠杆，我补充几个能直接落地的做法：</p>
<ol>
<li>派活时先给边界：直接写"只查 docker compose 和 nginx 相关配置，别动其他文件"，或者"先看容器日志里的 4xx/5xx"，把搜索范围框死，它就不会到处乱试。</li>
<li>要求先列假设再动手：让它"先列出 3-5 个可能原因并按概率排序，每个假设用最便宜的一条命令验证，验证完再回报"。这会把暴力搜索变成有导向的排查，省掉大量无关测试。</li>
<li>跑通后立刻固化：这次 mp4/协议 的完整排查路径值得让 Hermes 写成 skill（跟 kop-wang 说的固化思路一致），下次同类问题一步到位，成本能从几十次调用降到一次。</li>
<li>关于"正式版"模型名：0731 正式版沿用同一个模型名 deepseek-v4-flash，只是 SKU 后缀变了（OpenRouter 上能看到 -0731 这个新 SKU），Hermes 里不用改配置，模型列表里也不会单独多出一个"正式版"，你看到的是正常的。</li>
<li>大任务分段汇报：让它"每完成一个阶段先汇报再继续"，比一口气跑完更容易控制成本，中途出错也不用从头重来。</li>
</ol>
<p dir="auto">你那个"一下午 15 元"在排查类任务里属于正常范围（跟九龙杨生说的一致），但用上面几条，同类任务通常能压到三分之一甚至更低。另外一次思考一分半说明它在做长链路推理，只要搜索空间被框住，这种长思考反而划算。</p>
]]></description><link>https://lcz.me/post/11291</link><guid isPermaLink="true">https://lcz.me/post/11291</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Mon, 03 Aug 2026 07:17:21 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 05:12:30 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%E4%B9%9D%E9%BE%99%E6%9D%A8%E7%94%9F" aria-label="Profile: 九龙杨生">@<bdi>九龙杨生</bdi></a> 不是啥大项目就是本地一个docker compose，代理油管流量的，发现电脑可以播放，手机不能，让他帮我排查一下，结果就是手机浏览器支持mp4，不支持另一个协议，所以播放不了，hermes去做了大量的测试最后好在弄明白了。但是感觉成本有点儿高。正式版不用换模型，我看模型列表还是deepseek-v4-flash，没有一个单独的正式版。<a class="plugin-mentions-user plugin-mentions-a" href="/user/kop-wang" aria-label="Profile: kop-wang">@<bdi>kop-wang</bdi></a> 谢谢。感觉你不给它个排查方向，盲猜的话，它真的是暴力搜索，最终能解决，但是感觉成本太高，人还是要给他缩小搜索空间。</p>
]]></description><link>https://lcz.me/post/11282</link><guid isPermaLink="true">https://lcz.me/post/11282</guid><dc:creator><![CDATA[nami ryuu]]></dc:creator><pubDate>Mon, 03 Aug 2026 05:12:30 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 03:06:11 GMT]]></title><description><![CDATA[<p dir="auto">如果为了项目的准确性和严谨性在低价的基础上多消耗token是值得的；一下午用15元就我个人感觉来说是正常费用，我一天造卫星也是要用30多元。我是每一步结果都会让Hermes和子代理复核多遍保证结果的可用性，出来的代码BUG非常少，及时出现了也能很快修正好。flash比之前预览版好太多了。</p>
]]></description><link>https://lcz.me/post/11274</link><guid isPermaLink="true">https://lcz.me/post/11274</guid><dc:creator><![CDATA[九龙杨生]]></dc:creator><pubDate>Mon, 03 Aug 2026 03:06:11 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 02:21:02 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/nami-ryuu" aria-label="Profile: nami-ryuu">@<bdi>nami-ryuu</bdi></a> 这个很难比较，要看你的任务复杂度，以及hermes 整个推理的过程中是否总是因为试错而重复。</p>
<p dir="auto">比较粗略的省token的方法，主要就是当你跑通了一个路径之后，就让hermes把这个路径固定成skill，每次执行相同的任务则走相同的skill</p>
]]></description><link>https://lcz.me/post/11273</link><guid isPermaLink="true">https://lcz.me/post/11273</guid><dc:creator><![CDATA[kop wang]]></dc:creator><pubDate>Mon, 03 Aug 2026 02:21:02 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 02:14:53 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/kop-wang" aria-label="Profile: kop-wang">@<bdi>kop-wang</bdi></a> 那是不是我使用方式问题呢？我听站长说它每天很少两位数，都是8元解决一个大活，我感觉我没干啥就用了15，合计跟大家取取经，是不是我用得不对呢？有啥启发式的原则吗？谢谢！</p>
]]></description><link>https://lcz.me/post/11271</link><guid isPermaLink="true">https://lcz.me/post/11271</guid><dc:creator><![CDATA[nami ryuu]]></dc:creator><pubDate>Mon, 03 Aug 2026 02:14:53 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 02:03:27 GMT]]></title><description><![CDATA[<blockquote>
<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/kop-wang" aria-label="Profile: kop-wang">@<bdi>kop-wang</bdi></a> <a href="/post/11268">说</a>:</p>
<p dir="auto">如果你指的是“思考”，是一定要开的。思考可以帮你补齐你提示词的缺失和逻辑的部分错误。<br />
除非你是工具调工具，比如通过其他hermes实例，或者其他Agent，来调用hermes，可以考虑不开思考来降低信息干扰。</p>
</blockquote>
<p dir="auto">嗯，我也这样设置的</p>
]]></description><link>https://lcz.me/post/11269</link><guid isPermaLink="true">https://lcz.me/post/11269</guid><dc:creator><![CDATA[jrc jake]]></dc:creator><pubDate>Mon, 03 Aug 2026 02:03:27 GMT</pubDate></item><item><title><![CDATA[Reply to 请教一下大家deepseek v4 flash驱动hermes都开推理吗？ on Mon, 03 Aug 2026 01:59:09 GMT]]></title><description><![CDATA[<p dir="auto">如果你指的是“思考”，是一定要开的。思考可以帮你补齐你提示词的缺失和逻辑的部分错误。<br />
除非你是工具调工具，比如通过其他hermes实例，或者其他Agent，来调用hermes，可以考虑不开思考来降低信息干扰。</p>
]]></description><link>https://lcz.me/post/11268</link><guid isPermaLink="true">https://lcz.me/post/11268</guid><dc:creator><![CDATA[kop wang]]></dc:creator><pubDate>Mon, 03 Aug 2026 01:59:09 GMT</pubDate></item></channel></rss>