<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[【请教】对于7900xtx-24G和4070-8G这类小显存显卡，进行工具调用的模型有什么评分之类的信息出处供参考么？]]></title><description><![CDATA[<p dir="auto">粗略来说，除了那种特别全面强大的模型，现在是否有适合仅用于工具调用的模型；<br />
听人指挥，或者听更大的或者在线api指挥用。<br />
Qwen-3.6-35b-a3b和27b以及Gemma4-26b是最优选择了吗？<br />
不知是否有能够对比不同参数和量化模型的工具调用能力的排行榜之类的。</p>
]]></description><link>https://lcz.me/topic/1066/请教-对于7900xtx-24g和4070-8g这类小显存显卡-进行工具调用的模型有什么评分之类的信息出处供参考么</link><generator>RSS for Node</generator><lastBuildDate>Sat, 22 Aug 2026 04:22:32 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1066.rss" rel="self" type="application/rss+xml"/><pubDate>Sun, 09 Aug 2026 06:11:00 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 【请教】对于7900xtx-24G和4070-8G这类小显存显卡，进行工具调用的模型有什么评分之类的信息出处供参考么？ on Sun, 09 Aug 2026 21:56:41 GMT]]></title><description><![CDATA[<p dir="auto">7900xtx-24G 帖子很多 也很全面了。千问27B可以跑。也可以做具体工作。</p>
]]></description><link>https://lcz.me/post/11797</link><guid isPermaLink="true">https://lcz.me/post/11797</guid><dc:creator><![CDATA[williamlouis]]></dc:creator><pubDate>Sun, 09 Aug 2026 21:56:41 GMT</pubDate></item><item><title><![CDATA[Reply to 【请教】对于7900xtx-24G和4070-8G这类小显存显卡，进行工具调用的模型有什么评分之类的信息出处供参考么？ on Sun, 09 Aug 2026 19:37:15 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/stxpnet" aria-label="Profile: stxpnet">@<bdi>stxpnet</bdi></a> 5090 32G跑4比特版本也不错，就是上下文不嗨，自己用绝对是利器。</p>
]]></description><link>https://lcz.me/post/11792</link><guid isPermaLink="true">https://lcz.me/post/11792</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Sun, 09 Aug 2026 19:37:15 GMT</pubDate></item><item><title><![CDATA[Reply to 【请教】对于7900xtx-24G和4070-8G这类小显存显卡，进行工具调用的模型有什么评分之类的信息出处供参考么？ on Mon, 10 Aug 2026 01:44:48 GMT]]></title><description><![CDATA[<p dir="auto">个人浅见：老特的 48G 4090，或更高配置，加27B，再加一个合适的聊天模板，是基本跑起来的基准。<br />
再差一些的 32G要降点上下文，24G或以下显存的， 跑35B A3B，150K左右上下文。 或者是gemma4 26b qat.</p>
]]></description><link>https://lcz.me/post/11791</link><guid isPermaLink="true">https://lcz.me/post/11791</guid><dc:creator><![CDATA[stxpnet]]></dc:creator><pubDate>Mon, 10 Aug 2026 01:44:48 GMT</pubDate></item><item><title><![CDATA[Reply to 【请教】对于7900xtx-24G和4070-8G这类小显存显卡，进行工具调用的模型有什么评分之类的信息出处供参考么？ on Sun, 09 Aug 2026 07:09:24 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/happy" aria-label="Profile: happy">@<bdi>happy</bdi></a> 补一个 terry 没展开的部分：你要的「评分/排行榜出处」是有的，工具调用是少数几个有公认基准的方向。</p>
<ol>
<li>排行榜出处</li>
</ol>
<ul>
<li>Berkeley Function Calling Leaderboard（BFCL，<a href="http://gorilla.cs.berkeley.edu" rel="nofollow ugc">gorilla.cs.berkeley.edu</a>）——工具调用评测的事实标准，覆盖单轮/多轮/并行调用，按 pass@1 排名。Qwen 系列在里面对应档位都是第一梯队。</li>
<li>Sierra 的 τ-bench（<a href="http://tau-bench.com" rel="nofollow ugc">tau-bench.com</a>）——更偏「智能体干活」的评测，多轮工具调用 + 真实业务场景，比纯 function calling 更接近你说的「听人指挥」。</li>
<li>ToolBench、Gorilla OpenFunctions 也能参考，但更新频率不如前两个。</li>
<li>注意：基本没有「量化后工具调用能力」的排行榜——量化对工具调用的损伤只能自己测，方法见第 3 点。</li>
</ul>
<ol start="2">
<li>小显存怎么选</li>
</ol>
<ul>
<li>24G（7900xtx）：Qwen3-30B-A3B 这类小激活 MoE 是体感最优解——工具调用是几十轮往返，3B 激活的解码速度直接决定等待时间；Qwen3.6-27B dense 和 Gemma3-27B 的 Q4 也放得下，但速度差一截。</li>
<li>8G（4070）：27B 的 Q4 要 15G 以上，放不下。8G 实际能打的是 Qwen3-8B、GLM-4-9B（同尺寸里工具调用很强）、Gemma3-12B Q4 勉强压线。别为了「跑大模型」硬上 27B 的低量化档——工具调用对量化损伤比写文章敏感得多，降档后 function call 格式会先崩。</li>
</ul>
<ol start="3">
<li>自己测的方法<br />
BFCL 的评测集公开可下载，本地用 llama.cpp 的 JSON-schema grammar 或 vLLM 的 guided decoding 跑同一批 prompt，对比 pass@1 就行。比自己凭感觉换模型靠谱，也比等别人的二手结论快。</li>
</ol>
<p dir="auto">补充一句：terry 说 27B 最优是站在 24G 卡的角度，8G 卡的答案其实不一样——这就是上面第 2 点拆开说的原因。</p>
]]></description><link>https://lcz.me/post/11772</link><guid isPermaLink="true">https://lcz.me/post/11772</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Sun, 09 Aug 2026 07:09:24 GMT</pubDate></item><item><title><![CDATA[Reply to 【请教】对于7900xtx-24G和4070-8G这类小显存显卡，进行工具调用的模型有什么评分之类的信息出处供参考么？ on Sun, 09 Aug 2026 06:19:04 GMT]]></title><description><![CDATA[<p dir="auto">Qwen 27b最优解,不需要讨论了，其他差距太大，不值得对比。马上3.8发布，更是拉开差距</p>
]]></description><link>https://lcz.me/post/11770</link><guid isPermaLink="true">https://lcz.me/post/11770</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Sun, 09 Aug 2026 06:19:04 GMT</pubDate></item></channel></rss>