<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！）]]></title><description><![CDATA[<p dir="auto">主机名：magicz890-Ai<br />
操作系统：Ubuntu 24.04.4 LTS (Noble Numbat)<br />
内核：7.0.0-30-generic<br />
处理器：Intel Core Ultra 7 265K（20 线程）<br />
计算 GPU：AMD Radeon AI PRO R9700（32 GB）<br />
显示 GPU：Intel 核显（Arrow Lake-U，4K 输出）<br />
推理服务：qwen38.service（Qwen3.8-27B-Q5_K_M）</p>
<p dir="auto">本报告汇总了三次只读检查的完整结果：① 系统整体健康度与功耗；② 待机功耗与温度控制机制；③ 针对"学习 +日常办公 + 7×24 推理"用法的 GPU 功耗模式建议。所有数据均为实测，未执行任何修改操作。</p>
<p dir="auto">一、系统健康度与功耗报告</p>
<p dir="auto">1、系统概况<br />
<img src="https://upload.lcz.me/uploads/5b607341-c8cb-461b-af95-81821d9bb641.jpeg" alt="2ae89b5f-c023-4bfa-bdaa-37232f63cd71-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">2、温度（全部正常）<br />
<img src="https://upload.lcz.me/uploads/3d00e2b1-baa5-4e99-8ff5-00813bf0feb7.jpeg" alt="973bbe81-d828-4468-ac3e-57da93fe1c90-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">3、功耗（RAPL + rocm-smi 实测）<br />
<img src="https://upload.lcz.me/uploads/e443daaf-1581-48a3-b912-0e9b99cd9554.jpeg" alt="1f9321c9-e436-4d8b-801a-e2c1ac3a7c3d-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto">整机估算：推理时约 80–100 W，空闲时更低。功耗水平健康。</p>
<p dir="auto">4、llama.cpp 服务器（qwen38.service）<br />
<img src="https://upload.lcz.me/uploads/06e96cfd-f672-4e22-a36b-3e9c04febb98.jpeg" alt="48bf33a5-0df6-46f7-8aba-ce3c364fed01-image.jpeg" class=" img-fluid img-markdown" /><br />
<img src="https://upload.lcz.me/uploads/71459ad2-3248-4ada-8b22-adba66f9217d.jpeg" alt="5fb63038-3f4e-473e-b8cb-3c710945eaac-image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto"><strong>近期推理性能（日志实测，30 分钟内多次任务）</strong></p>
<ul>
<li>生成速度：37–44 tokens/s（tg_3s 峰值 47.4 t/s）</li>
<li>Prompt 处理：163–420 tokens/s</li>
<li>MTP 草稿接受率：0.78–0.88，平均长度 2.57–2.76（投机解码效果很好）</li>
<li>单次任务上下文 1.9–2.1 万 token，无截断、无报错</li>
</ul>
<p dir="auto"><strong>日志健康度</strong></p>
<p dir="auto">近 30 分钟日志全部为正常推理记录，无 error/warning。系统日志中仅有两类无害告警：gnome-shell dock 布局的常规噪音，以及 Canonical Livepatch 检查网络失败（<a href="http://livepatch.canonical.com" rel="nofollow ugc">livepatch.canonical.com</a> 连接 EOF，会自动重试，不影响系统）</p>
<h2>5 结论</h2>
<ul>
<li><strong>系统健康度：优 <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /></strong> —— 负载低、内存充裕、磁盘充足、CPU 温度 44°C、无 OOM/硬件错误。</li>
<li><strong>llama.cpp 服务器：健康且活跃 <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /></strong> —— 服务稳定运行 19 小时，推理吞吐 ~40 t/s，投机解码接受率 ~0.8，正在持续处理请求。</li>
<li><strong>功耗</strong>：CPU ~32 W + GPU ~50 W，整机推理时约 80–100 W，水平正常。</li>
<li><strong>唯一可留意点</strong>：GPU 显存温度 82°C 略偏高（推理满载时），以及显存占用 86%——均为 131k 长上下文 + 27B 模型的预期行为，暂无风险。</li>
</ul>
<h1>二、整机待机功耗与温度控制深度检查报告</h1>
<blockquote>
<p dir="auto"><strong>重要前提</strong>：这台机器没有真正的"待机"状态——<code>qwen38.service</code>（llama-server）在持续对外服务，检查期间它一直在处理推理任务。因此下面的"待机功耗"实际上是"轻载基线"：CPU 只忙 6.8%（推理在 GPU 上），但 GPU 随时会被唤醒。</p>
</blockquote>
<h2>2.1 待机（轻载）功耗实测</h2>
<p dir="auto"><strong>CPU 包（turbostat 两轮 5 秒采样）</strong></p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>指标</th>
<th>第 1 轮</th>
<th>第 2 轮</th>
</tr>
</thead>
<tbody>
<tr>
<td>PkgWatt（整包）</td>
<td>32.8 W</td>
<td>31.5 W</td>
</tr>
<tr>
<td>CorWatt（核心）</td>
<td>23.6 W</td>
<td>22.3 W</td>
</tr>
<tr>
<td>GFXWatt（核显）</td>
<td>0.45 W</td>
<td>0.44 W</td>
</tr>
<tr>
<td>RAMWatt</td>
<td>未测量（无 PMT 计数器）</td>
<td>—</td>
</tr>
<tr>
<td>CPU 忙碌度</td>
<td>6.8%</td>
<td>6.6%</td>
</tr>
<tr>
<td>平均频率</td>
<td>254 MHz</td>
<td>237 MHz</td>
</tr>
<tr>
<td>包温度</td>
<td>39 °C</td>
<td>39 °C</td>
</tr>
</tbody>
</table>
<p dir="auto"><strong>GPU（Radeon AI PRO R9700，rocm-smi 多次采样）</strong></p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>采样点</th>
<th>功耗</th>
<th>使用率</th>
</tr>
</thead>
<tbody>
<tr>
<td>采样 1</td>
<td>56 W（滑动平均）</td>
<td>3%</td>
</tr>
<tr>
<td>采样 2（6 秒后）</td>
<td>23 W</td>
<td>3%</td>
</tr>
</tbody>
</table>
<p dir="auto">GPU 空闲时自动降频：sclk 1128 MHz（最高 2350）、mclk 96 MHz（最高 1258）——降频策略工作正常。</p>
<p dir="auto"><strong>其他部件</strong></p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>部件</th>
<th>状态</th>
</tr>
</thead>
<tbody>
<tr>
<td>NVMe (nvme0n1)</td>
<td>温度 40 °C，IO 仅 ~184 KB/s，基本静默</td>
</tr>
<tr>
<td>核显（显示输出）</td>
<td>0.45 W，RC6 空闲态 17.6%</td>
</tr>
<tr>
<td>内存控制器 (SAM)</td>
<td>99.2% 时间处于 mc6 深度空闲</td>
</tr>
</tbody>
</table>
<p dir="auto"><strong>整机待机功耗估算</strong></p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>部件</th>
<th>功耗</th>
</tr>
</thead>
<tbody>
<tr>
<td>CPU 包</td>
<td>~32 W</td>
</tr>
<tr>
<td>GPU（空闲波动）</td>
<td>~23–56 W</td>
</tr>
<tr>
<td>内存 + 主板 + NVMe + 外设（估算）</td>
<td>~15–25 W</td>
</tr>
<tr>
<td><strong>整机合计（轻载基线）</strong></td>
<td><strong>约 70–110 W</strong></td>
</tr>
</tbody>
</table>
<p dir="auto">对比：推理满载时 CPU ~32 W + GPU 明显升高，整机约 100–150 W。</p>
<h2>2.2 温度控制情况</h2>
<p dir="auto"><strong>当前温度（全部健康）</strong></p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>部件</th>
<th>温度</th>
<th>评价</th>
</tr>
</thead>
<tbody>
<tr>
<td>CPU 包</td>
<td>39–40 °C</td>
<td>很凉</td>
</tr>
<tr>
<td>CPU 核心</td>
<td>38–40 °C</td>
<td>正常</td>
</tr>
<tr>
<td>GPU edge</td>
<td>62 °C（推理时 68–72）</td>
<td>正常</td>
</tr>
<tr>
<td>GPU junction</td>
<td>74 °C（推理时 79）</td>
<td>正常</td>
</tr>
<tr>
<td>GPU 显存</td>
<td>71 °C（推理峰值 82–91）</td>
<td>可接受，见建议</td>
</tr>
<tr>
<td>NVMe</td>
<td>40 °C</td>
<td>正常</td>
</tr>
<tr>
<td>主板 (acpitz)</td>
<td>27.8 °C</td>
<td>正常</td>
</tr>
</tbody>
</table>
<p dir="auto"><strong>热保护与调频机制（重点检查项）</strong></p>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>检查项</th>
<th>结果</th>
<th>评价</th>
</tr>
</thead>
<tbody>
<tr>
<td>热节流计数（package/core）</td>
<td>0 次 / 0 次</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 从未触发过热保护</td>
</tr>
<tr>
<td>CPU 调频驱动</td>
<td>intel_pstate + HWP 硬件调频</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 最优方案</td>
</tr>
<tr>
<td>调频策略</td>
<td>powersave，EPP：核心 0x40（balanced）、包 0x80（powersave）</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 偏节能配置</td>
</tr>
<tr>
<td>系统电源策略</td>
<td>power-profiles-daemon = balanced</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 合理</td>
</tr>
<tr>
<td>C 状态驻留</td>
<td>c1 40% / c6 30% / c7 22%</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 深度睡眠使用充分</td>
</tr>
<tr>
<td>内存控制器空闲</td>
<td>mc6 99.2%</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 优秀</td>
</tr>
<tr>
<td>GPU 空闲降频</td>
<td>sclk/mclk 均降至最低档</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正常</td>
</tr>
<tr>
<td>GPU 功耗模式</td>
<td>BOOTUP_DEFAULT（默认档）</td>
<td>可用，见建议</td>
</tr>
<tr>
<td>磁盘/定时任务</td>
<td>无异常 IO；定时任务正常</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /></td>
</tr>
</tbody>
</table>
<p dir="auto"><strong>部件健康度</strong></p>
<ul>
<li>NVMe：磨损 3%、备用块 100%、无 critical warning、通电 7269 小时——非常健康。</li>
<li>llama-server 服务：运行 19 小时无重启、无错误日志，推理 37–44 t/s，MTP 接受率 0.74–0.88。</li>
<li>系统日志仅两类无害告警：gnome-shell dock 布局噪音、Canonical Livepatch 联网检查失败（自动重试中，不影响运行）。</li>
</ul>
<h2>2.3 结论</h2>
<ul>
<li><strong>温度控制：优秀 <img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /></strong> —— 零热节流事件，CPU 39°C / GPU 62–74°C，HWP + powersave + 深度 C 状态全部生效，空闲降频正常。</li>
<li><strong>待机功耗：正常但偏高（约 70–110 W）</strong> —— 主要构成是 CPU 包 ~32 W（265K 是 125W TDP 的桌面级芯片，基线功耗天然不低）+ GPU 23–56 W + 平台开销。由于 LLM 服务器 7×24 运行，机器永远达不到纯待机。</li>
</ul>
<h2>2.4 建议（仅供参考，未执行任何一项）</h2>
<ol>
<li><strong>想测真实待机功耗</strong>：临时 <code>systemctl stop qwen38</code> 后再用 <code>turbostat</code> 采样，可看到纯平台基线（预计 CPU 包降到 ~20–25 W，整机 ~40–60 W）。测完 <code>systemctl start qwen38</code> 恢复。</li>
<li><strong>GPU 功耗模式</strong>：当前是 <code>BOOTUP_DEFAULT</code>。若主要跑推理，可考虑 <code>COMPUTE</code> 档，对计算负载的功耗/性能调度更优；混合用途则保持现状即可（详见报告三）。</li>
<li><strong>显存温度</strong>：推理满载时 82–91°C 属规格内但偏高，建议留意机箱风道；R9700 是涡轮卡，确保进风口无遮挡。</li>
<li><strong>加监控</strong>：llama-server 启动参数加 <code>--metrics</code>，之后 <code>/metrics</code> 端点可出 Prometheus 指标，配合现有 sysstat 定时任务做长期追踪。</li>
<li><strong>Livepatch 告警</strong>：<a href="http://livepatch.canonical.com" rel="nofollow ugc">livepatch.canonical.com</a> 连接失败在反复重试，若不用 Livepatch 可忽略；在意日志干净可考虑停用该服务。</li>
<li><strong>内存功耗不可测</strong>：turbostat 的 RAMWatt 为 0（该平台无 PMT 计数器），如需精确整机功耗，最可靠的方法是用外置功率计（插排计量插座）实测墙端功耗。</li>
</ol>
<hr />
<h1>三、GPU 功耗模式（COMPUTE 档）详细建议</h1>
<h2>3.1 关键发现：AMD 卡是"纯计算卡"</h2>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>GPU</th>
<th>型号</th>
<th>显示输出</th>
<th>角色</th>
</tr>
</thead>
<tbody>
<tr>
<td>card0</td>
<td>Intel 核显 (Arrow Lake-U)</td>
<td>HDMI-A-1 已连接，4K 3840×2160</td>
<td>负责所有显示/办公/学习画面</td>
</tr>
<tr>
<td>card1</td>
<td>AMD Radeon AI PRO R9700</td>
<td>无任何显示器连接</td>
<td>纯计算，只跑 LLM 推理</td>
</tr>
</tbody>
</table>
<p dir="auto">办公、学习、看网页、写文档时，AMD 卡完全空闲，画面全由 Intel 核显 + CPU 承担。AMD 卡唯一的活儿就是给 llama-server 做推理。对一块"只干计算、不碰显示"的卡，COMPUTE 档就是为它量身定做的。</p>
<h2>3.2 各档位差异（基于该卡实际 DPM 参数）</h2>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>档位</th>
<th>最低核心频率</th>
<th>功耗上限</th>
<th>加速 (Boost)</th>
<th>定位</th>
</tr>
</thead>
<tbody>
<tr>
<td>BOOTUP_DEFAULT（当前）</td>
<td>~500 MHz</td>
<td>800（较保守）</td>
<td>自动</td>
<td>通用均衡，偏省电</td>
</tr>
<tr>
<td>COMPUTE</td>
<td>600 MHz（固定下限）</td>
<td>16384（高，放开）</td>
<td>解除限制</td>
<td>持续计算优化</td>
</tr>
<tr>
<td>POWER_SAVING</td>
<td>~500 MHz</td>
<td>0</td>
<td>受限(3)</td>
<td>最省电，牺牲性能</td>
</tr>
<tr>
<td>3D_FULL_SCREEN / WINDOW_3D</td>
<td>~500 MHz</td>
<td>0</td>
<td>满加速(1)</td>
<td>游戏，瞬时高帧</td>
</tr>
<tr>
<td>VIDEO</td>
<td>~500 MHz</td>
<td>500</td>
<td>自动</td>
<td>视频播放省电</td>
</tr>
<tr>
<td>VR</td>
<td>600 MHz</td>
<td>16384</td>
<td>解除</td>
<td>与 COMPUTE 几乎相同</td>
</tr>
</tbody>
</table>
<p dir="auto">核心差异两点：</p>
<ol>
<li>COMPUTE 把核心频率下限抬到 600 MHz（默认约 500），空闲时略高一点点；</li>
<li>COMPUTE 放开了功耗上限（16384 vs 800）并解除加速限制——长时间推理时 GPU 能维持更高、更稳定的频率，不容易被功耗墙压频。</li>
</ol>
<h2>3.3 建议：切到 COMPUTE 档</h2>
<p dir="auto"><strong>理由（针对"学习 + 办公 + 7×24 推理"场景）：</strong></p>
<ol>
<li><strong>负载性质完全匹配</strong>：AMD 卡 100% 的负载是推理（持续计算），COMPUTE 正是为这种"长时间、稳定、吃算力和显存带宽"的负载调的。</li>
<li><strong>减少长推理压频</strong>：单次任务动辄 2–4 万 token、跑十几秒，属持续负载。默认档的保守功耗墙（800）更易触发降频；COMPUTE 放开功耗墙后，长任务的 tokens/s 更稳、峰值更高。</li>
<li><strong>没有"显示"副作用</strong>：显示器接在 Intel 核显上，COMPUTE 抬高的频率下限不会让办公画面变卡或更耗电——那块卡办公时根本闲着。</li>
<li><strong>代价极小</strong>：600 vs 500 MHz 的下限差，空闲功耗只多 ~1–2 W，可忽略；温度方面 GPU 现在才 62–74°C，余量充足。</li>
</ol>
<p dir="auto"><strong>什么情况下不建议切（供权衡）：</strong></p>
<ul>
<li>若把"极致省电"排在"推理速度"前面，且能接受推理略慢/略不稳，保持 <code>BOOTUP_DEFAULT</code> 也完全没问题——它本就是安全的均衡档。</li>
<li>但就"卡只干推理"的用法看，COMPUTE 的收益（更稳更快的推理）明显大于代价（多 1–2 W 空闲功耗）。</li>
</ul>
<blockquote>
<p dir="auto"><strong>一句话结论：建议切 COMPUTE。</strong> 它和这块纯计算卡的用法是最佳匹配，收益实在、代价可忽略。</p>
</blockquote>
<h2>3.4 如何验证（A/B 测试，建议先测再定）</h2>
<ol>
<li>
<p dir="auto"><strong>记录基线（当前 BOOTUP_DEFAULT）</strong>：跑一个固定 prompt 的推理，记下 tokens/s、<code>rocm-smi --showpower</code>、GPU 温度。</p>
</li>
<li>
<p dir="auto"><strong>临时切档（立即生效，重启即还原，不改任何文件）</strong>：</p>
<pre><code class="language-bash">echo 5 | sudo tee /sys/class/drm/card1/device/pp_power_profile_mode
</code></pre>
<p dir="auto">（5 = COMPUTE；改完用 <code>cat</code> 同一文件确认，<code>*</code> 号会移到 COMPUTE 上）</p>
</li>
<li>
<p dir="auto"><strong>重复同样的推理</strong>，对比 tokens/s、功耗、温度。</p>
</li>
<li>
<p dir="auto"><strong>满意就保留</strong>，不满意 <code>echo 0 | sudo tee ...</code> 切回默认。</p>
</li>
</ol>
<blockquote>
<p dir="auto">注意：<code>pp_power_profile_mode</code> 是运行时设置，重启后会回到 <code>BOOTUP_DEFAULT</code>。</p>
</blockquote>
<h2>3.5 若决定长期用 COMPUTE，如何持久化（三选一）</h2>
<ol>
<li><strong>systemd 覆盖 qwen38.service</strong>（最贴合，随推理服务一起生效）：加一个 <code>ExecStartPre</code> 在启动 llama-server 前写入档位。</li>
<li><strong>udev 规则</strong>：在 amdgpu 设备就绪时自动写入，开机即生效，与具体服务解耦。</li>
<li><strong>独立 oneshot systemd 服务</strong>：开机跑一次 <code>echo 5 &gt; .../pp_power_profile_mode</code>。</li>
</ol>
<p dir="auto">三者都能做到"开机自动 COMPUTE"，选 1 最省事（和推理服务绑定）。</p>
<h2>3.6 补充提醒</h2>
<ul>
<li>切档后留意一次满载温度：显存峰值到过 82–91°C，COMPUTE 放开功耗墙后满载会略热，确认机箱风道没问题即可（R9700 是涡轮卡，别堵进风口）。</li>
<li>这个改动只影响 AMD 计算卡，对办公/学习的 Intel 核显显示路径零影响。</li>
<li>按用户要求，本次未做任何修改，以上全部是查看 + 建议。</li>
</ul>
<hr />
<p dir="auto"><em>本报告由只读检查生成，所有数据均为实测值。检查过程中未对系统、服务或配置做任何修改。生成工具：weasyprint（HTML → PDF），字体：Noto Sans CJK SC。</em></p>
<p dir="auto">刚学会用.md文件，后期是用.md文件复制过来的，请包含，版面有点乱。小白积极参与请大家多多包涵</p>
<p dir="auto">刚拍了张照片测试下<br />
<img src="https://upload.lcz.me/uploads/41045695-11a5-4b8e-88e5-4e7fd6858db0.jpg" alt="微信图片_20260908235715_40_4.jpg" class=" img-fluid img-markdown" /></p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/fcefcc08-9e25-4c1a-ba78-f16c92188a99.jpg" alt="微信图片_20260908235714_39_4.jpg" class=" img-fluid img-markdown" /></p>
]]></description><link>https://lcz.me/topic/1569</link><generator>RSS for Node</generator><lastBuildDate>Thu, 10 Sep 2026 00:44:07 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1569.rss" rel="self" type="application/rss+xml"/><pubDate>Tue, 08 Sep 2026 16:04:38 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！） on Wed, 09 Sep 2026 18:44:09 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/agi" aria-label="Profile: AGI">@<bdi>AGI</bdi></a> 本地大模型部署在虚拟环境下的具体方案可以简单说一下吗？谢谢。</p>
]]></description><link>https://lcz.me/post/16946</link><guid isPermaLink="true">https://lcz.me/post/16946</guid><dc:creator><![CDATA[Magic629]]></dc:creator><pubDate>Wed, 09 Sep 2026 18:44:09 GMT</pubDate></item><item><title><![CDATA[Reply to Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！） on Wed, 09 Sep 2026 10:58:27 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/agi" aria-label="Profile: AGI">@<bdi>AGI</bdi></a> 谢谢分享，学习了。</p>
]]></description><link>https://lcz.me/post/16876</link><guid isPermaLink="true">https://lcz.me/post/16876</guid><dc:creator><![CDATA[Magic629]]></dc:creator><pubDate>Wed, 09 Sep 2026 10:58:27 GMT</pubDate></item><item><title><![CDATA[Reply to Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！） on Wed, 09 Sep 2026 08:04:03 GMT]]></title><description><![CDATA[<p dir="auto">7900xtx待机时候功耗不到20w，一般15w以下。环境 proxmox + Ubuntu 26.04 server VM。还跑着其他VMs，总体待机功耗70左右。</p>
<p dir="auto">其他配置: 2696 V4 + 4x64G DDR4 + 1T SATA SSD+ 18T HDD.</p>
<p dir="auto">这几天北方降温，我机箱盖子因为各种原因，盖不住，温度满负载不到70度，显卡功耗最高300w。平时待机就是30多度的温度</p>
]]></description><link>https://lcz.me/post/16858</link><guid isPermaLink="true">https://lcz.me/post/16858</guid><dc:creator><![CDATA[AGI]]></dc:creator><pubDate>Wed, 09 Sep 2026 08:04:03 GMT</pubDate></item><item><title><![CDATA[Reply to Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！） on Tue, 08 Sep 2026 19:04:36 GMT]]></title><description><![CDATA[<p dir="auto">报告质量很高，几个数字帮你标定一下，都在物理区间内、机器是健康的：</p>
<ol>
<li>
<p dir="auto">37–44 t/s（峰值 47）——R9700 640GB/s 带宽下，27B Q5_K_M 就该落在这个带，没有优化空间了。MTP 接受率 0.78–0.88 / 平均 2.57–2.76，说明 draft head 吃得很满，已经是最优区间，不用再调。</p>
</li>
<li>
<p dir="auto">82°C 是显存 junction（温感探针）读数，RDNA 显存控制器的热裕量比这高得多，长期 131K 长上下文负载下这个温度正常，不是风险；edge 62–72°C 更是凉快。想让它再降，可以 --override-kv 或压低功耗档，但没必要为 82°C 牺牲性能。</p>
</li>
<li>
<p dir="auto">86% 显存 = 19G 权重 + 长上下文 KV，正好卡在 32G 的合理填充区。想给多开或更长上下文留头，手柄是 KV 量化（Q8→Q4）或把默认上下文从 131K 降回 64K——日常用不着那么长。</p>
</li>
</ol>
<p dir="auto">整体这台机器 7×24 挂着 70–110W 待机、满载 ~150W，是"学习 + 办公 + 常驻推理"最省心的形态，选型对了。唯一留意点是 Canonical Livepatch 网络 EOF，无害，忽略即可。</p>
]]></description><link>https://lcz.me/post/16779</link><guid isPermaLink="true">https://lcz.me/post/16779</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Tue, 08 Sep 2026 19:04:36 GMT</pubDate></item><item><title><![CDATA[Reply to Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！） on Tue, 08 Sep 2026 18:25:02 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/terry" aria-label="Profile: terry">@<bdi>terry</bdi></a> 好的特哥，下次继续改进</p>
]]></description><link>https://lcz.me/post/16776</link><guid isPermaLink="true">https://lcz.me/post/16776</guid><dc:creator><![CDATA[Magic629]]></dc:creator><pubDate>Tue, 08 Sep 2026 18:25:02 GMT</pubDate></item><item><title><![CDATA[Reply to Ubuntu 24 系统与 llama.cpp 服务器  健康度 · 功耗 · 温度控制 综合检查报告 （小白慢慢补图，我先报告完供大神审阅指正，谢谢！） on Tue, 08 Sep 2026 18:22:17 GMT]]></title><description><![CDATA[<p dir="auto">非常好的分享，真实拍照很好，不过可以拍清晰点。表格尽量避免截图，用markdown，就是让AI帮你整理成Markdown，你不要手动整理。</p>
]]></description><link>https://lcz.me/post/16775</link><guid isPermaLink="true">https://lcz.me/post/16775</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Tue, 08 Sep 2026 18:22:17 GMT</pubDate></item></channel></rss>