AMD pro R9700显卡已经拿到了,主机是新攒的,准备装机,请论坛内的大神、老玩家们给些开荒意见,帮着避避坑,谢谢啦,将持续上报后续作业。
-
基本上你上完ubuntu後就不會再去看你的電腦畫面了,之後全程hermes代勞了,所以應該不用太擔心不習慣的問題,我也是過來人!!一開始win11轉ubuntu挺擔心不會用的,後來發現根本用不太到~頂多開檔案總管看comfyi出的圖,最後也把google driver接上同步,就再也沒去電腦前了,偶爾rustdesk遠端連過去
-
@wml-ai 看来你是折腾过了。windows 11 双显卡 集成显卡+独立显卡 的设置真是千奇百怪。windows 使用率在这个ai时代下滑是有原因的。曾经的生态王者 现在各种拉缸。
@wml-ai 看来你是折腾过了。windows 11 双显卡 集成显卡+独立显卡 的设置真是千奇百怪。windows 使用率在这个ai时代下滑是有原因的。曾经的生态王者 现在各种拉缸。
我没折腾Win11,直接就上Ubuntu了。Window打中学就开始用,DOS6.22、Windows3.1、95、98、98SE、2000、Vista、Win7,现在的笔记本是Win10。单位有电脑是Win11的,感觉除了界面好看点,其他的不如我的Win10习惯。
其实Ubuntu也不陌生,以前也用过,不过年轻时玩心重,总想打游戏,所以也没好好学Linux。今年又买了Mac mini,又重温了一些命令行操作,有AI了就更方便了。
我对Windows上运行WSL比较抵触,这玩意是个套娃,肯定性能有损失,我花了大价钱配的硬件,为什么不让它在原生环境里发挥最高性能呢?!而且以前我曾经试过在Windows上跑VM Workstation,然后虚拟机运行黑群晖,黑群晖里运行Docker(为了运行一套开源软件),搞得我崩溃。最后还是弃用Docker,直接在Windows上部署那套软件。
你在Windows里面套一个WSL,看似你是在一个熟悉的系统中,但是WSL2的跨系统文件 I/O 性能极差,而且虚拟机要和宿主机分享系统内存,还有就是最让我挠头的是局域网配置,当初我就是因为Docker环境配置网络端口总也搞不好才放弃的。本来你在原生Linux环境中没有那么麻烦的配置过程,可能在WSL2这个套娃里就会很麻烦,而且浪费了硬件资源。
我现在就是把Ubuntu当成AI服务器,主要用Mac mini SSH到Ubuntu上,偶尔也会登录到Ubuntu的桌面(偶尔也拿Ubuntu打会游戏
)。出门了就用Windows笔记本远程登录到Mac上,拿Mac mini当一个跳板机(功耗超低,24小时开机)。
所以我不想再折腾Windows+WSL2了。以前折腾过,累了,烦了。现在这三台主机运行的都很好——满意! -
@wml-ai 看来你是折腾过了。windows 11 双显卡 集成显卡+独立显卡 的设置真是千奇百怪。windows 使用率在这个ai时代下滑是有原因的。曾经的生态王者 现在各种拉缸。
-
野心很大啊。直接干了2张。分析 R9700这种胎带小带宽其实更适合双卡或4卡
-
@andyfay 双 R9700 走 vLLM TP=2 对"跑大模型"是实打实的提升,不是折腾——但得分清楚提升在哪:
-
原理:LLM 解码瓶颈是显存带宽。R9700 单卡带宽偏小(williamlouis 前面说的"胎带小带宽"),单卡跑 27B Q4 解码被带宽锁死;TP=2 把权重和 KV 拆到两张卡并行读,有效带宽翻倍 → 27B Q4 解码大概从单卡 30-40 提到 60-70 t/s 量级(实际取决于 PCIe 与 all-reduce 效率;无 P2P 时 prefill 有约 15-20% 损失,解码损失小,TID:988 有数据)。
-
对比 4090 48G:单卡 1008GB/s 带宽、CUDA 生态省心、48G 容量对 27B+长上下文绰绰有余;代价是魔改卡没保修(TID:1114 维修经历就是活教材),而且 4090 的带宽优势只在单卡场景成立。
-
决策分场景:纯 LLM(27B-70B Q4、长上下文、多并发)→ 双 R9700 64G + TP 更划算,容量和带宽都赢;如果你还要跑 ComfyUI 视频生成 → ComfyUI 不吃 TP,双卡帮不上忙,4090 48G 单卡更稳。
-
楼主 GH Y 已经双 R9700 装机了(PID:9178 提到两块都确认 PCIe 5.0),你 13:50 问的单卡 vs 双卡对比他还没答——正好请 @GH Y 跑个 qwen3.8-27B 单卡 vs TP=2 实测,论坛一堆人等着抄作业。
-



