<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[看着视频，学着大神的贴子对于“魔改SGLANG支持7900XTX 双卡TP”的坎坷学习路。]]></title><description><![CDATA[<p dir="auto">看着视频，学着大神的贴子对于“魔改SGLANG支持7900XTX 双卡TP”的坎坷学习路，还是总结了一下，指点。活都是ai做的，我就是跟在ai操作下学习一下方法。哈。下面是正文</p>
<h1>【踩坑实录】双 7900XTX 跑 SGLang TP=2 —— 从物理挪卡到裸机 LXC 验证，X99 平台 TP 死局全记录</h1>
<blockquote>
<p dir="auto">2026-09-07 ~ 2026-09-09 · 三天折腾，结论：平台死，不是软件锅<br />
硬件：X99-T8D 双路 E5-2696v3 + 2× RX 7900 XTX + PVE 9.2<br />
目标：双卡张量并行（TP=2）跑 SGLang 魔改 fork（gfx1100 分支）</p>
</blockquote>
<hr />
<h2>一、结果先讲</h2>
<p dir="auto"><strong>TP=2 方向关闭。死因：Intel X99 root complex 不支持 GPU 间 P2P 路由。</strong></p>
<p dir="auto">软件栈全装通了（ROCm 7.14 + torch 2.11 + fork 编译 + 模型加载都过了），死在最后一关：双卡通信实测 <code>hipDeviceCanAccessPeer = NO</code>。</p>
<p dir="auto">不是 VFIO 的问题（LXC 验证了），不是虚拟化层的问题（LXC 等价裸机也验证了），是 <strong>Intel 平台硬件本身就没有这个能力</strong>。</p>
<hr />
<h2>二、踩坑顺序（重点：我走的路径全是错的顺序）</h2>
<h3>阶段 0（错）：先装软件，后查硬件</h3>
<p dir="auto">这是最大的坑。<strong>我花了一天时间装 ROCm 7.14、torch 2.11、SGLang fork 编译，结果最后 5 分钟就能查出来的问题，让我先走了几天弯路。</strong></p>
<p dir="auto">正确的顺序应该是：<strong>先查硬件 P2P 能力，再决定要不要装软件。</strong></p>
<p dir="auto">5 分钟硬件预检命令：</p>
<pre><code class="language-bash"># 1. 两卡是否在同一个 CPU socket 下？
lspci -D | grep -iE "vga|3d controller"
# 看 bus 号：0x:xx = CPU0 域，8x:xx = CPU1 域
# 如果一张 04:00 一张 86:00 → 跨 CPU socket，TP 直接判死

# 2. IOMMU group 是否独立？
for d in &lt;gpu1_bdf&gt; &lt;gpu2_bdf&gt;; do
  echo "$d -&gt; group $(basename $(readlink /sys/bus/pci/devices/$d/iommu_group))"
done
# 如果两张卡在不同的 IOMMU group → 没有 peer DMA 路径
</code></pre>
<p dir="auto"><strong>这两个检查如果一开始就做了，三天变三小时。</strong></p>
<hr />
<h3>阶段 1：初始报错 —— 双卡不在同一 CPU</h3>
<p dir="auto">VM104 里装好了 ROCm 7.14 + fork，启动 SGLang TP=2，直接报错：</p>
<pre><code>RCCL error: communication failure between GPUs
</code></pre>
<p dir="auto"><strong>当时的误判</strong>：以为是软件配置问题，开始查 RCCL 环境变量、torch 版本匹配、编译参数。</p>
<p dir="auto"><strong>实际原因</strong>：两张卡分别在 CPU0（bus 04）和 CPU1（bus 86）下，跨 socket 通信走 QPI/UPI，PVE 直通下没有 peer DMA 路径。</p>
<hr />
<h3>阶段 2：物理挪卡 —— 同一 CPU 下还不行</h3>
<p dir="auto"><strong>操作</strong>：把原来挂在 CPU1 侧的卡拔下来，插到 CPU0 侧空着的 x16 槽里。</p>
<p dir="auto"><strong>验证</strong>（重启后）：</p>
<ul>
<li>卡1：<code>04:00.0</code> → CPU0-Port2（Gen3 x16）</li>
<li>卡2：<code>07:00.0</code> → CPU0-Port3（Gen3 x16）</li>
</ul>
<p dir="auto">两张卡都挂在 CPU0 下了。<strong>但 TP=2 还是不通。</strong></p>
<p dir="auto"><strong>为什么同 CPU 还不够？</strong></p>
<p dir="auto">两张卡虽然在同一 CPU，但：</p>
<ol>
<li>各挂一个独立的 root port（00:02.0 和 00:03.0）</li>
<li>各属一个独立的 IOMMU group（54 和 58）</li>
<li>每张卡还经过板载 Navi10 PCIe 交换芯片（板上的 retimer）</li>
</ol>
<p dir="auto">IOMMU 的 peer DMA 隔离是按 group 切的，跨 group 默认拒绝。要两卡同 group，必须挂在同一个 PCIe switch 的下游（x8+x8 拆分），X99-T8D 的布局做不到。</p>
<p dir="auto"><strong>教训</strong>：同 CPU 是 P2P 的必要条件，不是充分条件。还需要同 IOMMU group（同 PCIe switch 下游）。</p>
<hr />
<h3>阶段 3：怀疑虚拟化层（VFIO）</h3>
<p dir="auto"><strong>当时的逻辑</strong>（后来被 hermes 验证是对的推理方向）：</p>
<ul>
<li>vfio-pci 直通本身不做跨设备 peer DMA</li>
<li>guest 内核看到的 PCIe 拓扑是 QEMU 伪造的（BDF 重编成 01:00/02:00，不是物理 BDF）</li>
<li>所以 VM 里测试 NO 不能证明物理机也 NO</li>
</ul>
<p dir="auto"><strong>验证方案</strong>：不重装系统（代价太大），用 LXC 容器代替。</p>
<p dir="auto"><strong>为什么 LXC 能模拟裸机？</strong></p>
<ul>
<li>LXC 容器共享宿主内核，没有自己的内核</li>
<li>GPU 不需要 vfio 直通，宿主直接用 amdgpu 驱动</li>
<li>容器里的 ROCm 用户态通过 <code>/dev/kfd</code> + <code>/dev/dri</code> 访问 GPU</li>
<li>KFD 看到的是宿主真实的 PCIe 拓扑</li>
<li><strong>等价于裸机的硬件条件</strong></li>
</ul>
<p dir="auto"><strong>操作步骤</strong>：</p>
<ol>
<li>改宿主 modprobe 配置：GPU 从 vfio-pci 切回 amdgpu</li>
<li>重启宿主（冷启动，不能热切！）</li>
<li>建 LXC 200（Ubuntu 24.04），放行 <code>/dev/kfd</code> + <code>/dev/dri</code></li>
<li>容器内装 ROCm 7.14 用户态</li>
<li>跑 HIP 测试程序</li>
</ol>
<p dir="auto"><strong>LXC 实测结果</strong>：</p>
<pre><code>hipDeviceCanAccessPeer(0→1) = NO
hipDeviceCanAccessPeer(1→0) = NO
KFD p2p_links 目录为空
跨卡 memcpy = 3.1 GB/s（纯主机内存中转）
</code></pre>
<p dir="auto"><strong>结论</strong>：虚拟化不是原因。Intel X99 root complex 本身就不提供 GPU 间 P2P/原子路由。</p>
<p dir="auto"><strong>BIOS 能救吗？</strong> 不能。</p>
<ul>
<li>Above 4G Decoding（大 BAR）已开（唯一的前提条件）</li>
<li>Intel X99 平台没有 "enable P2P" 选项（这类选项不存在于 Intel 平台）</li>
<li>root port 的 AtomicOpsCap = Routing-（实测），这是芯片能力，BIOS 改不了</li>
</ul>
<hr />
<h2>三、最终根因</h2>
<p dir="auto"><strong>Intel Haswell-EP 的 root complex 没有 GPU 间 peer DMA 路由能力。</strong></p>
<ul>
<li>AMD 平台的 GMI/infinity fabric 北桥原生支持 peer 路由</li>
<li>Intel 平台的 RC 不支持（或支持极弱）</li>
<li>两张卡的数据路径必须穿过 root complex</li>
<li>Intel RC 不提供 GPU 间直连路由</li>
</ul>
<p dir="auto"><strong>对照成功案例</strong>：所有 GPU P2P 跑通的案例都是：</p>
<ul>
<li>AMD 单路平台（AM4/AM5/TRX40/TRX50），GMI 原生 peer 路由</li>
<li>或加 PLX 交换卡，两卡挂到同一 switch 下游（绕开 RC）</li>
</ul>
<p dir="auto"><strong>Intel X99/Z270 等消费/工作站平台：无成功先例。</strong></p>
<hr />
<h2>四、必须避的坑（按重要性排序）</h2>
<h3>坑 1：先装软件再查硬件（最大坑）</h3>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 错误：装了一天的 ROCm + fork，才去查硬件<br />
<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正确：5 分钟跑完硬件预检，再决定要不要装软件</p>
<pre><code class="language-bash"># 5 分钟预检脚本
echo "=== GPU BDF 和 CPU socket 归属 ==="
lspci -D | grep -iE "vga|3d"
for d in $(lspci -D | grep -iE "vga|3d" | awk '{print $1}'); do
  bus=${d%%:*}
  if [[ $bus &lt; 0x80 ]]; then
    echo "$d → CPU0 域"
  else
    echo "$d → CPU1 域"
  fi
done

echo "=== IOMMU group ==="
for d in $(lspci -D | grep -iE "vga|3d" | awk '{print $1}'); do
  grp=$(basename $(readlink /sys/bus/pci/devices/$d/iommu_group) 2&gt;/dev/null)
  echo "$d → group $grp"
done
</code></pre>
<p dir="auto"><strong>如果两卡跨 CPU 或跨 IOMMU group，直接停止，TP 方向关闭。</strong></p>
<h3>坑 2：同 CPU ≠ 有 P2P</h3>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 错误：以为把两张卡挪到同一 CPU 就能通<br />
<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正确：同 CPU 是必要条件，还需要同 IOMMU group</p>
<p dir="auto">X99-T8D 的两个独立 root port（00:02.0 和 00:03.0）分属两个 IOMMU group，<br />
即使物理位置都挂在 CPU0 侧，照样没有 peer DMA。</p>
<h3>坑 3：VFIO 直通天然不支持 peer DMA</h3>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 错误：以为 VM 里 P2P 不通是虚拟化层的锅，去折腾 VFIO 配置<br />
<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正确：VFIO 直通<strong>设计上就不支持</strong>跨设备 peer DMA，这不是配置问题</p>
<p dir="auto">即使物理机能通，VM 直通也通不了（除非用 vIOMMU + 特殊内核支持，PVE 不支持）。</p>
<h3>坑 4：LXC 能模拟裸机，但不救平台</h3>
<p dir="auto">LXC 验证的意义是<strong>排除虚拟化层的干扰</strong>，确认"裸机也不行"。<br />
但如果平台本身不支持 P2P（如 Intel X99），LXC 也救不了。</p>
<h3>坑 5：驱动热切换会锁卡</h3>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 错误：vfio → amdgpu 热切换（<code>echo "..." &gt; /sys/bus/pci/drivers/vfio-pci/unbind</code>）<br />
<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正确：必须冷启动（改 modprobe 配置后重启）</p>
<p dir="auto">热切换可能导致 GPU 进入 D3hot 状态无法唤醒，PCI reset 都救不了，只能重启宿主。</p>
<h3>坑 6：PCIe 速率看错位置</h3>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 错误：看 GPU 端点的 lspci 输出（显示 16GT/s x16）<br />
<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正确：看 root port 侧（真实槽速）</p>
<p dir="auto">GPU 端点显示的速率是"卡内 switch → 卡"那一段，不是端到端速率。<br />
真实瓶颈在 root port 侧（8GT/s Gen3），以 root port 的 <code>LnkSta</code> 为准。</p>
<h3>坑 7：ROCm 版本和源（装软件阶段）</h3>
<p dir="auto">如果决定装软件，注意：</p>
<ul>
<li>ROCm 7.14 的源在 <code>repo.amd.com/rocm/packages-multi-arch/ubuntu2404</code></li>
<li>包名带版本后缀：<code>amdrocm-core-dev7.14-gfx1100</code></li>
<li>torch wheel 要 curl 直接下（flat 目录不是 pip 索引），不能 <code>pip install --index-url</code></li>
</ul>
<h3>坑 8：PVE 双卡直通 romfile 冲突</h3>
<p dir="auto"><img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/274c.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--x" style="height:23px;width:auto;vertical-align:middle" title="❌" alt="❌" /> 错误：两张卡共用同一个 romfile<br />
<img src="https://lcz.me/assets/plugins/nodebb-plugin-emoji/emoji/android/2705.png?v=301515bb865" class="not-responsive emoji emoji-android emoji--white_check_mark" style="height:23px;width:auto;vertical-align:middle" title="✅" alt="✅" /> 正确：必须复制一份异名的 rom（如 <code>7900XTX_dump.rom</code> 和 <code>7900XTX_dump2.rom</code>）</p>
<hr />
<h2>五、排查正确顺序（建议存为 checklist）</h2>
<pre><code>双卡 TP 可行性排查（5 分钟版）：

1. CPU socket 检查
   lspci -D | grep -iE "vga|3d"
   → 两卡 bus 号一个 0x:xx 一个 8x:xx？
   → YES = 跨 CPU，TP 判死，停止

2. IOMMU group 检查
   for d in &lt;gpu1&gt; &lt;gpu2&gt;; do
     basename $(readlink /sys/bus/pci/devices/$d/iommu_group)
   done
   → 不同 group？
   → YES = 无 peer DMA 路径，TP 判死，停止

3. 平台检查
   主板是 Intel X99/Z270/X299 等？
   → YES = 无 P2P 成功先例，TP 判死，停止

4. （以上全通过才继续）
   装软件 → 实测 hipDeviceCanAccessPeer
</code></pre>
<p dir="auto"><strong>走完前三步，能省掉 90% 的无谓折腾。</strong></p>
<hr />
<h2>六、那这两张卡还能干嘛？</h2>
<p dir="auto">TP 死局，但两张卡不是废铁：</p>
<ol>
<li>
<p dir="auto"><strong>双实例并行</strong>（推荐）<br />
每张卡各跑一个独立的单卡推理服务，互不通信</p>
<ul>
<li>VM102 跑模型 A</li>
<li>VM103 跑模型 B</li>
<li>两卡各自满载，总吞吐 = 2× 单卡吞吐</li>
<li>这是当前拓扑下性价比最高的用法</li>
</ul>
</li>
<li>
<p dir="auto"><strong>llama.cpp 分层并行</strong>（<code>--split-mode layer</code>）<br />
各卡独立计算不同层，卡间只传激活值（走 CPU 内存中转）</p>
<ul>
<li>不要求 P2P，3.1 GB/s 够用</li>
<li>社区有 5×7900XTX 长期稳定运行的先例</li>
<li>双卡 48GB 显存可跑 ~48GB 权重模型</li>
</ul>
</li>
<li>
<p dir="auto"><strong>换平台</strong>（如果有 TP 刚需）</p>
<ul>
<li>AMD AM5 单路（X670E 等），双卡 x8+x8，GMI 原生 peer 路由</li>
<li>或加 PLX PEX 交换卡（成本高，X99 槽位/散热不友好）</li>
</ul>
</li>
</ol>
<hr />
<h2>七、总结</h2>
<table class="table table-bordered table-striped">
<thead>
<tr>
<th>阶段</th>
<th>操作</th>
<th>结果</th>
<th>教训</th>
</tr>
</thead>
<tbody>
<tr>
<td>1</td>
<td>装 ROCm + fork</td>
<td>编译过，import 过</td>
<td>顺序错了，应先查硬件</td>
</tr>
<tr>
<td>2</td>
<td>VM104 启动 SGLang</td>
<td>RCCL 通信崩</td>
<td>跨 CPU socket，无 P2P</td>
</tr>
<tr>
<td>3</td>
<td>物理挪卡到同 CPU</td>
<td>还是不通</td>
<td>同 CPU 不够，还要同 IOMMU group</td>
</tr>
<tr>
<td>4</td>
<td>怀疑 VFIO 层</td>
<td>LXC 验证</td>
<td>虚拟化不是原因</td>
</tr>
<tr>
<td>5</td>
<td>LXC 原生 amdgpu</td>
<td>还是 NO</td>
<td>平台本身不支持</td>
</tr>
<tr>
<td>6</td>
<td>查 root port 能力</td>
<td>AtomicOpsCap = Routing-</td>
<td>Intel RC 无 peer 路由</td>
</tr>
</tbody>
</table>
<p dir="auto"><strong>核心教训</strong>：</p>
<ol>
<li>先硬件后软件，5 分钟预检省三天弯路</li>
<li>双路主板跨 socket 无 P2P，结构性死局</li>
<li>同 CPU 同 IOMMU group 是 P2P 的两个必要条件，缺一不可</li>
<li>Intel 消费/工作站平台无成功先例</li>
<li>换平台（AMD 单路）是最实际的解法</li>
</ol>
<hr />
<p dir="auto"><em>本文已脱敏（无 IP、无具体用户名、无内部系统标识），可直接发技术社区。</em> 现在ai真是贴心。</p>
]]></description><link>https://lcz.me/topic/1589</link><generator>RSS for Node</generator><lastBuildDate>Wed, 09 Sep 2026 22:53:51 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1589.rss" rel="self" type="application/rss+xml"/><pubDate>Wed, 09 Sep 2026 15:01:22 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 看着视频，学着大神的贴子对于“魔改SGLANG支持7900XTX 双卡TP”的坎坷学习路。 on Wed, 09 Sep 2026 17:44:53 GMT]]></title><description><![CDATA[<p dir="auto">人手服务器主板，但可惜都不是最适合跑大模型的</p>
]]></description><link>https://lcz.me/post/16942</link><guid isPermaLink="true">https://lcz.me/post/16942</guid><dc:creator><![CDATA[johnnybegood]]></dc:creator><pubDate>Wed, 09 Sep 2026 17:44:53 GMT</pubDate></item><item><title><![CDATA[Reply to 看着视频，学着大神的贴子对于“魔改SGLANG支持7900XTX 双卡TP”的坎坷学习路。 on Wed, 09 Sep 2026 17:30:33 GMT]]></title><description><![CDATA[<p dir="auto"><a class="plugin-mentions-user plugin-mentions-a" href="/user/abaalei" aria-label="Profile: abaalei">@<bdi>abaalei</bdi></a> 感觉x99还是太老了，epyc应该下一个娱乐场</p>
]]></description><link>https://lcz.me/post/16941</link><guid isPermaLink="true">https://lcz.me/post/16941</guid><dc:creator><![CDATA[拐子001]]></dc:creator><pubDate>Wed, 09 Sep 2026 17:30:33 GMT</pubDate></item><item><title><![CDATA[Reply to 看着视频，学着大神的贴子对于“魔改SGLANG支持7900XTX 双卡TP”的坎坷学习路。 on Wed, 09 Sep 2026 16:05:30 GMT]]></title><description><![CDATA[<p dir="auto">周末三天折腾总结得很到位，结论完全成立：X99 root complex 不支持 GPU P2P，SGLang 走 RCCL 张量并行在这平台就是死局。这也跟论坛之前的结论对上了——RDNA 卡在 SGLang 用 RCCL 做 TP，要么 stock 版根本没启用（RCCL 默认关），要么就算打通了也常是负优化（TID:1438 实测 TP 无 P2P 硬崩，要 NCCL_PROTO=Simple 才从 0.94 拉到 23，绕一大圈）。</p>
<p dir="auto">补一个你踩坑里可能没注意到、其实更省事的分叉点：<strong>TP 不是双卡加速的唯一路径</strong>，对 RDNA3 来说甚至不一定是最优路径。关键看你要的是"单个模型跑更快"还是"显存容量翻倍"：</p>
<ul>
<li><strong>llama.cpp Vulkan tensor-split 不需要 P2P</strong>。它按层把权重分到两张卡，层间走标准 PCIe，根本不需要 peer DMA。所以双 7900XTX 用 Vulkan tensor-split，不需要同 IOMMU group、不需要 PCIe switch 下游，X99 也能跑。大模型 decode 是带宽驱动，权重按层分出去后等效带宽叠上去，实测能拿 1.5× 左右的单模型提升。</li>
<li><strong>SGLang 的 RCCL 张量并行才真正依赖 P2P</strong>，你的 X99-T8D 给不出来，所以这条路在你这台机就是死，不用再试了。</li>
</ul>
<p dir="auto">所以：目标如果是"双 7900XTX 跑 27B 更快"，别再折腾 SGLang TP，直接 llama.cpp + tensor-split 就能见效，平台不用换；如果非得上 SGLang 那套（长上下文 prefix cache、多 agent 并发），才需要换 EPYC/B650+ 这类能 P2P 的平台，或走你参考的魔改 fork 那条线（TID:1532）。</p>
<p dir="auto">你那两个硬件预检命令（lspci 看 bus、查 iommu_group）写得很实用，建议再加一句：装软件前先跑这两个检查，真能三天变三小时。</p>
]]></description><link>https://lcz.me/post/16930</link><guid isPermaLink="true">https://lcz.me/post/16930</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Wed, 09 Sep 2026 16:05:30 GMT</pubDate></item><item><title><![CDATA[Reply to 看着视频，学着大神的贴子对于“魔改SGLANG支持7900XTX 双卡TP”的坎坷学习路。 on Wed, 09 Sep 2026 15:33:27 GMT]]></title><description><![CDATA[<p dir="auto">哈哈 x99我很久之前就发帖提过不支持p2p，用sglang是难点。不过现在新的是咋样就没了解了，刚换了epyc平台卡就坏了，哎</p>
]]></description><link>https://lcz.me/post/16927</link><guid isPermaLink="true">https://lcz.me/post/16927</guid><dc:creator><![CDATA[abaalei]]></dc:creator><pubDate>Wed, 09 Sep 2026 15:33:27 GMT</pubDate></item></channel></rss>