<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流]]></title><description><![CDATA[<blockquote>
<p dir="auto"><strong>适用人群：</strong></p>
<ul>
<li>想跑 MiniMax H3 / Ref2VA / FL2VA</li>
<li>想做长视频、动作戏、打斗、镜头衔接</li>
<li>想在有限显存下追求画质最大化</li>
</ul>
</blockquote>
<hr />
<h2>🟥 为什么 12GB 显存也能跑长视频？</h2>
<p dir="auto">AI 视频推理显存需求动辄 24GB+，但通过 <strong>精度压缩、分段推理、显存碎片管理、软硬件分治</strong>，12GB 卡依然能做到：</p>
<ul>
<li><strong>长视频分段生成（&gt;60 秒）</strong></li>
<li><strong>高动态动作戏稳定推理</strong></li>
<li><strong>4K 超分放大（RTX VSR）</strong></li>
<li><strong>画质不衰减的连续镜头</strong></li>
</ul>
<p dir="auto">下面是完整的工作流拆解。</p>
<hr />
<h1>🟦 一、硬件与环境约束</h1>
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f5a5.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--desktop_computer" style="height:23px;width:auto;vertical-align:middle" title="🖥" alt="🖥" />️ 核心配置</h2>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>项目</th>
<th>配置</th>
</tr>
</thead>
<tbody>
<tr>
<td>GPU</td>
<td><strong>RTX 5070（12GB VRAM）</strong></td>
</tr>
<tr>
<td>CPU</td>
<td>Ryzen 5700X</td>
</tr>
<tr>
<td>RAM</td>
<td>64GB</td>
</tr>
<tr>
<td>存储</td>
<td>SSD （48GB虚拟内存）</td>
</tr>
</tbody>
</table>
<hr />
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f512.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--lock" style="height:23px;width:auto;vertical-align:middle" title="🔒" alt="🔒" /> 稳定策略：功耗墙锁死 80%</h2>
<p dir="auto">锁功耗墙的好处：</p>
<ul>
<li>避免瞬时电流尖峰导致黑屏</li>
<li>显存颗粒温度更低</li>
<li>长时间推理不掉帧</li>
<li>显卡寿命更健康</li>
<li>性能下降不足5%</li>
</ul>
<hr />
<h1>🟦 二、模型与推理工作流（ComfyUI）</h1>
<h2>🧬 1. 混合权重（Hybrid）</h2>
<p dir="auto">兼顾 <strong>Ref2VA 的可控性</strong> 与 <strong>FL2VA 的画质</strong>：</p>
<pre><code>minimax_h3_ref2va_hybrid_b20-49_pruned_w4a8_mixed.safetensors
qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
minimax_h3_video_vae_int8_convrot.safetensors
minimax_h3_audio_vae_fp32.safetensors
</code></pre>
<p dir="auto">加速 LoRA：</p>
<pre><code>minimax_h3_turbo_v4_step600_ema.safetensors
</code></pre>
<hr />
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2699.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--gear" style="height:23px;width:auto;vertical-align:middle" title="⚙" alt="⚙" />️ 2. 精度方案：<strong>W4A8（黄金分割点）</strong></h2>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>精度</th>
<th>显存占用</th>
<th>画质</th>
<th>推荐度</th>
</tr>
</thead>
<tbody>
<tr>
<td>FP16</td>
<td>高</td>
<td>优秀</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 12GB 不稳</td>
</tr>
<tr>
<td>INT8 ConvRot</td>
<td>中</td>
<td>良好</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2714.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--heavy_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✔" alt="✔" /> 可用</td>
</tr>
<tr>
<td><strong>W4A8</strong></td>
<td><strong>低</strong></td>
<td><strong>良好</strong></td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2b50.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--star" style="height:23px;width:auto;vertical-align:middle" title="⭐" alt="⭐" /> 最佳平衡</td>
</tr>
<tr>
<td>NVFP4</td>
<td>低</td>
<td>良好</td>
<td><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2714.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--heavy_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✔" alt="✔" /> 50系专用</td>
</tr>
</tbody>
</table>
<hr />
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f680.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--rocket" style="height:23px;width:auto;vertical-align:middle" title="🚀" alt="🚀" /> 3. 加速引擎</h2>
<ul>
<li><strong>MiniMax H3 Mem Eff Patch / Sage Attention Patch</strong></li>
<li><strong>Block Sparse Attention</strong></li>
<li><strong>TE-Speed-MiniMaxH3 (3.5+)</strong></li>
</ul>
<p dir="auto">三者组合可减少 35–50% 推理时间。</p>
<hr />
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f3ac.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--clapper" style="height:23px;width:auto;vertical-align:middle" title="🎬" alt="🎬" /> 4. 动态步数策略</h2>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>场景类型</th>
<th>步数</th>
<th>10 秒0.5M视频推理时间</th>
</tr>
</thead>
<tbody>
<tr>
<td>文戏 / 静态</td>
<td><strong>6-step</strong></td>
<td>~150s</td>
</tr>
<tr>
<td>动作戏 / 打斗</td>
<td><strong>8-step</strong></td>
<td>~200s</td>
</tr>
</tbody>
</table>
<hr />
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f501.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--repeat" style="height:23px;width:auto;vertical-align:middle" title="🔁" alt="🔁" /> 5. 分段生成 + 引导重绘策略（长视频关键）</h2>
<h3><strong>核心逻辑：</strong></h3>
<ul>
<li>使用“<a href="https://github.com/AIMixer/ComfyUI_MiniMaxH3_Director" rel="nofollow ugc">minmax h3 导演台</a>”节点进行分段</li>
<li>每段生成 10 秒 视频</li>
<li>下一段以上一段的 <strong>尾帧</strong> 作为视频和声音引导</li>
<li>重绘幅度设为 <strong>0.65</strong><br />
<strong>建议：勾选每段生成后清理一次显存。</strong></li>
</ul>
<h3>效果：</h3>
<ul>
<li>动作连续性提升一个档次</li>
<li>长视频画质不衰减</li>
<li>镜头衔接自然无跳帧</li>
</ul>
<hr />
<h1>🟦 三、画质放大与修复（The “4K Strategy”）</h1>
<blockquote>
<p dir="auto"><strong>目标：</strong> 在不进行离线 4K 推理的情况下，最终输出依然达到 4K 观感。</p>
</blockquote>
<hr />
<h2>🧩 第一阶段：视频质量修复（VOSR 2.0）</h2>
<p dir="auto">输入：960×544<br />
输出：1080p</p>
<p dir="auto">VOSR 的优势：</p>
<ul>
<li>修复硬线条</li>
<li>修复文字</li>
<li>修复人物皮肤</li>
</ul>
<hr />
<h2><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/1f4c8.png?v=ffa14597167" class="not-responsive emoji emoji-android emoji--chart_with_upwards_trend" style="height:23px;width:auto;vertical-align:middle" title="📈" alt="📈" /> 第二阶段：视频超分放大（RTX VSR）</h2>
<p dir="auto">RTX+Video+Super+Resolution视频放大<br />
输入：1080p<br />
输出：4K</p>
<ul>
<li>基于 TensorRT 引擎</li>
<li>几乎不占显存</li>
<li>画质提升显著</li>
<li>适合长视频放大</li>
</ul>
<hr />
<h1>🟩 四、最终总结</h1>
<p dir="auto">即使只有 <strong>12GB 显存</strong>：</p>
<ul>
<li><strong>通过 W4A8 精度压缩</strong></li>
<li><strong>加速LORA</strong></li>
<li><strong>分段重绘策略</strong></li>
<li><strong>VOSR + RTX VSR 两段式增强</strong></li>
</ul>
<p dir="auto">依然可以实现：</p>
<ul>
<li><strong>长视频生成</strong></li>
<li><strong>动作戏稳定推理</strong></li>
<li><strong>4K 观感输出</strong></li>
<li><strong>画质不衰减的连续镜头</strong></li>
</ul>
<p dir="auto">如果你也在用 50 系列或 40 系列显卡跑 MiniMax H3，欢迎在评论区分享你的工作流参数。</p>
<hr />
]]></description><link>https://lcz.me/topic/1743</link><generator>RSS for Node</generator><lastBuildDate>Sun, 20 Sep 2026 17:09:30 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1743.rss" rel="self" type="application/rss+xml"/><pubDate>Wed, 16 Sep 2026 06:51:14 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 14:25:43 GMT]]></title><description><![CDATA[<p dir="auto">NV的生态好。拿到流都可以试试。<br />
Windows下也可以直接上。<br />
操作：<br />
1.安装 comfy UI<br />
2.拖拽 工作流 到 web 页面<br />
3.点击报错页面 选择一键下载全部缺失内容（正常是模型，节点都可以一次解决）。下载失败可能是你的VPN的问题。</p>
]]></description><link>https://lcz.me/post/18871</link><guid isPermaLink="true">https://lcz.me/post/18871</guid><dc:creator><![CDATA[williamlouis]]></dc:creator><pubDate>Thu, 17 Sep 2026 14:25:43 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 12:34:27 GMT]]></title><description><![CDATA[<p dir="auto">非常好的分享，12G显存能玩，本身就是胜利。实际上刘悦很多工作流也是低显存能玩，只不过慢而已。你的 分享很不错，很细致。</p>
]]></description><link>https://lcz.me/post/18850</link><guid isPermaLink="true">https://lcz.me/post/18850</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Thu, 17 Sep 2026 12:34:27 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 04:31:34 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/terry" aria-label="Profile: terry">@<bdi>terry</bdi></a> 已经分享全部工作流。</p>
]]></description><link>https://lcz.me/post/18789</link><guid isPermaLink="true">https://lcz.me/post/18789</guid><dc:creator><![CDATA[perter]]></dc:creator><pubDate>Thu, 17 Sep 2026 04:31:34 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 04:18:04 GMT]]></title><description><![CDATA[<p dir="auto"><strong>视频超分放大（RTX VSR） 工作流</strong><br />
<img src="https://upload.lcz.me/uploads/12162065-bec1-49fd-82df-a378c796195b.jpeg" alt="image.jpeg" class=" img-fluid img-markdown" /><br />
<a href="https://upload.lcz.me/uploads/e04737ea-4a40-46df-bf40-4bfbecc3469b.json" rel="nofollow ugc">视频超分放大（RTX VSR）.json</a></p>
]]></description><link>https://lcz.me/post/18787</link><guid isPermaLink="true">https://lcz.me/post/18787</guid><dc:creator><![CDATA[perter]]></dc:creator><pubDate>Thu, 17 Sep 2026 04:18:04 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 04:14:41 GMT]]></title><description><![CDATA[<p dir="auto"><strong>视频放大修复（VOSR 2.0）工作流</strong><br />
<img src="https://upload.lcz.me/uploads/f83c4219-ccfe-4b69-a1b3-70657221e05c.jpeg" alt="image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto"><a href="https://upload.lcz.me/uploads/ef8701a2-b2e6-47ab-9e05-30dc834e09a4.json" rel="nofollow ugc">视频修复放大【VOSR2】.json</a></p>
]]></description><link>https://lcz.me/post/18785</link><guid isPermaLink="true">https://lcz.me/post/18785</guid><dc:creator><![CDATA[perter]]></dc:creator><pubDate>Thu, 17 Sep 2026 04:14:41 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 03:19:04 GMT]]></title><description><![CDATA[<p dir="auto"><strong>MiniMax+H3+导演台全能工作流_加速版工作流</strong></p>
<p dir="auto"><img src="https://upload.lcz.me/uploads/8183926f-d051-4e6e-9544-2f4e7f9c1f25.jpeg" alt="image.jpeg" class=" img-fluid img-markdown" /></p>
<p dir="auto"><strong>实测	10 秒0.5M视频8step推理时间163秒</strong><br />
<img src="https://upload.lcz.me/uploads/f8c7d078-d6b0-47d0-b8ec-dde764f34e7f.jpeg" alt="image.jpeg" class=" img-fluid img-markdown" /><br />
<a href="https://upload.lcz.me/uploads/8c13ecc7-b8f5-40d3-91c2-2c7ac600d1bb.json" rel="nofollow ugc">MiniMax+H3+导演台全能工作流_加速版.json</a></p>
]]></description><link>https://lcz.me/post/18768</link><guid isPermaLink="true">https://lcz.me/post/18768</guid><dc:creator><![CDATA[perter]]></dc:creator><pubDate>Thu, 17 Sep 2026 03:19:04 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Thu, 17 Sep 2026 01:02:36 GMT]]></title><description><![CDATA[<p dir="auto">12GB 能做长视频这点没问题，W4A8 + 分块稀疏 + 顺序卸载这套是对的。但有两处得说清楚，不然容易误导后面的人：</p>
<ol>
<li>RTX VSR 是显示端的视频增强，做的是更好看的放大，不是生成式细节重建。4K 输出会更锐，但原始帧里没有的信息它补不出来，「画质不衰减」不成立。真要 4K 细节，得上生成式超分（SUPIR / SeedVR2）或高分辨率重绘，代价是显存和时间都按帧算。</li>
<li>锁 80% 功耗墙换稳定是对的（压瞬态尖峰），但代价不止 5%：prefill 和大 batch 段会明显吃算力，只有 decode 段（带宽瓶颈）几乎无感。评估时把 prefill 与 decode 分开测。</li>
</ol>
<p dir="auto">另外分段生成 60 秒以上，段与段之间建议用首尾帧 + 上段末帧做条件，否则动作戏跨段容易跳。工作流如果放出来可以贴一下，我按上面几条帮你对一遍。</p>
]]></description><link>https://lcz.me/post/18749</link><guid isPermaLink="true">https://lcz.me/post/18749</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Thu, 17 Sep 2026 01:02:36 GMT</pubDate></item><item><title><![CDATA[Reply to 【硬核实测】12GB 显存的极限救赎：我的 MiniMax H3 本地生成与 4K 超分工作流 on Wed, 16 Sep 2026 13:31:19 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/perter" aria-label="Profile: perter">@<bdi>perter</bdi></a> 有工作流和成品吗？纯云？</p>
]]></description><link>https://lcz.me/post/18643</link><guid isPermaLink="true">https://lcz.me/post/18643</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Wed, 16 Sep 2026 13:31:19 GMT</pubDate></item></channel></rss>