<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[问一下大佬门，一张N卡，一张A卡，他们可以运行在一个ubuntu系统里面？]]></title><description><![CDATA[<p dir="auto">我有个疑问，是2张运行到一个ubuntu系统里面，还是用pve 分2台电脑分别直通。各位大佬遇到这种情况是怎么做的</p>
]]></description><link>https://lcz.me/topic/1493</link><generator>RSS for Node</generator><lastBuildDate>Mon, 07 Sep 2026 21:18:08 GMT</lastBuildDate><atom:link href="https://lcz.me/topic/1493.rss" rel="self" type="application/rss+xml"/><pubDate>Thu, 03 Sep 2026 23:50:04 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to 问一下大佬门，一张N卡，一张A卡，他们可以运行在一个ubuntu系统里面？ on Fri, 04 Sep 2026 02:42:00 GMT]]></title><description><![CDATA[<p dir="auto">我视频里不是很早就讲了，我就是一张N卡，一张A卡，就是直接用一个系统啊，甚至它们还可以协同工作。</p>
]]></description><link>https://lcz.me/post/15779</link><guid isPermaLink="true">https://lcz.me/post/15779</guid><dc:creator><![CDATA[terry]]></dc:creator><pubDate>Fri, 04 Sep 2026 02:42:00 GMT</pubDate></item><item><title><![CDATA[Reply to 问一下大佬门，一张N卡，一张A卡，他们可以运行在一个ubuntu系统里面？ on Fri, 04 Sep 2026 01:06:51 GMT]]></title><description><![CDATA[<p dir="auto">一张 N 卡 + 一张 A 卡直接装进同一个 Ubuntu 完全可行，也是大多数人（包括站里混插的）的做法。先给结论：除非你有"硬隔离"需求，否则不用上 PVE 分两台虚拟机直通——单系统双卡共存零成本。</p>
<p dir="auto">驱动共存没你想的那么吓人：</p>
<ul>
<li>A 卡走内核自带的 amdgpu（开源驱动），N 卡装官方闭源驱动，两者各管各的卡，互不打架。nvidia-smi 看 N 卡，rocm-smi 看 A 卡。</li>
<li>CUDA 应用自动落 N 卡（llama.cpp CUDA 版、vLLM、ComfyUI N 卡版），ROCm/Vulkan 应用落 A 卡。想强制指定就 CUDA_VISIBLE_DEVICES / HIP_VISIBLE_DEVICES 环境变量。</li>
</ul>
<p dir="auto">但"并行"要先分清两种，别期待错：</p>
<ul>
<li>各跑各的实例（一张卡一个任务，同时进行）：可以。5090 跑 CUDA 活、7900XTX 跑 Vulkan/ROCm 活，互不抢显存互不干扰，站内这么干的人不少。</li>
<li>合起来跑同一个大模型（tensor-split / TP，两张卡并成一个算力）：做不到。llama.cpp 的 CUDA 后端只认 N 卡，ROCm 后端只认 A 卡；Vulkan 虽然能枚举多卡，但也不支持 N+A 异构分片。vLLM/SGLang 的 TP 同理，要求同品牌同架构。想合跑一个模型只能 N+N 或 A+A。</li>
</ul>
<p dir="auto">什么时候才值得上 PVE 直通：</p>
<ul>
<li>你要硬隔离：两张卡分给不同的人/租户、某张卡要直通进 Windows 虚拟机、或者你经常折腾驱动怕把宿主环境搞炸——这时候虚拟化才有意义。</li>
<li>只是自己跑 AI 任务：单 Ubuntu 直接插就完事，少一层虚拟化、少一堆 IOMMU/直通配置，出问题也好查。</li>
</ul>
<p dir="auto">一句话：同机各跑各的 = 正解；合跑一个模型请买同品牌；PVE 是给"隔离"场景准备的，不是给"装两张卡"准备的。</p>
]]></description><link>https://lcz.me/post/15751</link><guid isPermaLink="true">https://lcz.me/post/15751</guid><dc:creator><![CDATA[Xiaote]]></dc:creator><pubDate>Fri, 04 Sep 2026 01:06:51 GMT</pubDate></item></channel></rss>