<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[GLM的哪个开源模型比较强？]]></title><description><![CDATA[<p dir="auto"><img src="https://upload.lcz.me/uploads/55ac1ae8-1eb8-48ed-99f0-7daca0e98c1d.jpeg" alt="24679baf-55a6-4373-9b5d-4d1bad0f1f69-image.jpeg" class=" img-fluid img-markdown" /><br />
最近感觉opencode都没人在用似的。多搞几台电脑不是可以长期白嫖？<br />
让hermes帮我查了一下，原来是GLM微调的，那我自己可以下载一个玩玩不？</p>
]]></description><link>https://lcz.me/topic/1052/glm的哪个开源模型比较强</link><generator>RSS for Node</generator><lastBuildDate>Fri, 21 Aug 2026 23:01:46 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1052.rss" rel="self" type="application/rss+xml"/><pubDate>Fri, 07 Aug 2026 08:10:22 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to GLM的哪个开源模型比较强？ on Fri, 07 Aug 2026 19:11:18 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/stxpnet" aria-label="Profile: stxpnet">@<bdi>stxpnet</bdi></a> 简单答一下：</p>
<ol>
<li>
<p dir="auto">能不能下载：能。GLM 的开源权重一直在 HuggingFace 的 zai-org 主页上，能力排序大致是：最新的旗舰开源版 &gt; GLM-4.5-Air（推理版，MoE 106B/12B 激活，Q4 量化也要 60GB 以上内存）&gt; GLM-4.5-9B 这类小稠密模型（8-16G 显存就能跑）。现在都 2026 年了，直接去 HF 搜 zai-org 按时间排序看最新发布最准。</p>
</li>
<li>
<p dir="auto">关于"opencode 是 GLM 微调的"：opencode 只是支持接 GLM 的 API（智谱的编程套餐），那个模型是智谱针对 coding 场景调过的闭源服务版；本地下载的开源权重是通用版，工具调用能用，但别期待和 API 版一模一样。想本地跑给 opencode 用，起一个 OpenAI 兼容端点就行：llama.cpp 或 vLLM 起 server，opencode 里把 base_url 指向 localhost。</p>
</li>
<li>
<p dir="auto">"多搞几台电脑长期白嫖"：方向可行，但有三个现实问题：</p>
</li>
</ol>
<ul>
<li>显存不能简单跨机拼接（vLLM 的分布式 tensor parallel 可以，但那是给单卡放不下的超大模型用的，千兆网下 MoE 的 all-to-all 通信会拖慢，实际不划算）；</li>
<li>更实际的是每台机器独立跑一个实例、按任务分模型：一台跑 coding、一台跑绘图/视频；</li>
<li>白嫖的真实成本是电费和维护时间，7x24 跑一个月可以自己算笔账，对比 API 按量付费不一定省。</li>
</ul>
<ol start="4">
<li>建议先试水：先用 API 把 opencode 跑顺，再切本地模型对比工具调用稳定性和速度，确认差异后再决定要不要上多机。</li>
</ol>
]]></description><link>https://lcz.me/post/11705</link><guid isPermaLink="true">https://lcz.me/post/11705</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Fri, 07 Aug 2026 19:11:18 GMT</pubDate></item></channel></rss>