4080s,32g魔改版与R9700价钱接近,怎么选,本地跑大模型
-
三个候选我都说下,结论放最后:
-
二手 7900XTX(~5100):性价比之王。960GB/s 带宽,纯 decode 比 R9700 快 30~50%(TID:1298 算过这笔账),27B 跑 Q4/Q5 + 64K 上下文无压力。短板是 24G 天花板:32B 级模型 Q4 勉强装、27B 上 Q8 就没地方放 KV。你担心"以后模型越来越大",这正是它的死穴。
-
R9700 32G(~11000):原生 32G + 全新带保 + RDNA4 功耗低,Windows 下 Vulkan 跑 llama.cpp 完全没问题(论坛 R9700 实测帖不少)。32G 是"显存舒适区":27B 上 Q8、32B 上 Q4 都从容,未来两三年不用为显存焦虑。短板:带宽 640GB/s 比 7900XTX 低一截,decode 速度差点;CUDA-only 的工具(TensorRT、部分 ComfyUI 节点)用不了。
-
魔改 4080s 32G(~13680):32G + CUDA 生态全兼容,听起来完美,但 13680 买个魔改卡是最不值的选项——改显存涉及焊接和供电改动,散热、驱动稳定性、寿命都是未知数,没保修,转手也难。论坛 TID:1277 就有 3070 魔改卡在 Ubuntu 黑屏的避雷实录(Windows 能跑 ≠ 长期稳定)。除非你明确需要 CUDA-only 的东西且能接受风险,否则不推荐。
你的情况:Windows 11 主力机 + 750W 电源 + 265k,单卡随便带:R9700(~300W)、魔改 4080s(~320W)、7900XTX(~355W)都够。
结论:
- 预算够、想省心、怕显存不够 → R9700 32G,一步到位;
- 极致性价比、接受 24G 上限 → 二手 7900XTX,省下 6000+ 干别的;
- 魔改 4080s → 不推荐,13680 买的是风险不是性能。
顺带:你闲鱼看到的 7900XTX 二手 5100 是捡漏价(论坛里新卡被炒到 7000+,TID:1298 有讨论),如果成色没问题,先拿它过渡、等 R9700 降价再升级,也是个务实路线。
-
-
小孩子才做选择。。。我们全都要
-
两个我都买了张,个人感觉4080s 32g跑llm更快,跑视频也更好,就是有时候会奇怪的有点像花屏了一样,魔改卡还是比较不省心。r9700这张卡感觉跑llm有点慢,不如7900xtx,跑模型最好找rocm特化版的,能稍微快一点
-
两个我都买了张,个人感觉4080s 32g跑llm更快,跑视频也更好,就是有时候会奇怪的有点像花屏了一样,魔改卡还是比较不省心。r9700这张卡感觉跑llm有点慢,不如7900xtx,跑模型最好找rocm特化版的,能稍微快一点
@stormaround 闲鱼这个老卖家4080s是水冷版,发热与噪音应该问题不大,就怕显存时间长了,出问题。另外,价钱贵了,9700,京东价钱也到12000,所以,不好选择
-
除非你能自己 DIY 4080S 不然魔改怎么玩儿。没太看明白。
修显卡的老张我问了。最近拒绝维修 魔改显卡。。。。。。。 -
除非你能自己 DIY 4080S 不然魔改怎么玩儿。没太看明白。
修显卡的老张我问了。最近拒绝维修 魔改显卡。。。。。。。@williamlouis 好的,确实风险很大,还计划买个16g的,让老张换显存呢
-
两个我都买了张,个人感觉4080s 32g跑llm更快,跑视频也更好,就是有时候会奇怪的有点像花屏了一样,魔改卡还是比较不省心。r9700这张卡感觉跑llm有点慢,不如7900xtx,跑模型最好找rocm特化版的,能稍微快一点
@stormaround 花屏,应该就是过热,显存焊点接触不良,冷却以后就好了吧
-
@stormaround 花屏,应该就是过热,显存焊点接触不良,冷却以后就好了吧
@stormaround 花屏,应该就是过热,显存焊点接触不良,冷却以后就好了吧
不常出现,就是突然有点彩色点
-
两个我都买了张,个人感觉4080s 32g跑llm更快,跑视频也更好,就是有时候会奇怪的有点像花屏了一样,魔改卡还是比较不省心。r9700这张卡感觉跑llm有点慢,不如7900xtx,跑模型最好找rocm特化版的,能稍微快一点
@stormaround 你在哪个平台买的4080s,魔改卡呢,我找找
-
@gzctgj 维修概率几乎是100%。你没看老特的视频吗?自营不担心。肯定能修好。
注意购买途径吧。@williamlouis 好的,知道了
-
我这张是今年 3 月在淘宝“睡不醒的85后显卡研究所”买的 4080S 32G 配用40903风扇的魔改卡,目前一直正常。购买后一直折腾在找适合自己的模型和推理配置。
现在日常主力用的是 dealignai/Qwen3.8-27B-CRACK-GGUF,已经稳定跑了一段时间。实测同模型、上下文262144,Q8 KV、MTP=3、单并发实测:满格320W 约 63.56 tok/s,250W 约 53.81 tok/s,320W 快约 18%。 这个速度算是够用了。
我平时用能耗墙锁定 248/250W 挂机风扇非常安静,需要跑视频、压测或追吞吐时再开 320W风扇自适配82%转速虽然有点吵,但是和服务器单风扇版本完全不是一个量级的安静。个人感觉,只要卖家靠谱、散热供电正常、不乱超显存,4080S 32G 魔改卡完全可以做本地大模型主力卡。
-
我这张是今年 3 月在淘宝“睡不醒的85后显卡研究所”买的 4080S 32G 配用40903风扇的魔改卡,目前一直正常。购买后一直折腾在找适合自己的模型和推理配置。
现在日常主力用的是 dealignai/Qwen3.8-27B-CRACK-GGUF,已经稳定跑了一段时间。实测同模型、上下文262144,Q8 KV、MTP=3、单并发实测:满格320W 约 63.56 tok/s,250W 约 53.81 tok/s,320W 快约 18%。 这个速度算是够用了。
我平时用能耗墙锁定 248/250W 挂机风扇非常安静,需要跑视频、压测或追吞吐时再开 320W风扇自适配82%转速虽然有点吵,但是和服务器单风扇版本完全不是一个量级的安静。个人感觉,只要卖家靠谱、散热供电正常、不乱超显存,4080S 32G 魔改卡完全可以做本地大模型主力卡。
@Takano-RR 这种就是没自营靠谱 这个人闲鱼和淘宝都有 问了核心挂了保不保 也说保的 但感觉毕竟是个人 淘宝店铺这种说没就没了 闲鱼更是没法管
-
我这张是今年 3 月在淘宝“睡不醒的85后显卡研究所”买的 4080S 32G 配用40903风扇的魔改卡,目前一直正常。购买后一直折腾在找适合自己的模型和推理配置。
现在日常主力用的是 dealignai/Qwen3.8-27B-CRACK-GGUF,已经稳定跑了一段时间。实测同模型、上下文262144,Q8 KV、MTP=3、单并发实测:满格320W 约 63.56 tok/s,250W 约 53.81 tok/s,320W 快约 18%。 这个速度算是够用了。
我平时用能耗墙锁定 248/250W 挂机风扇非常安静,需要跑视频、压测或追吞吐时再开 320W风扇自适配82%转速虽然有点吵,但是和服务器单风扇版本完全不是一个量级的安静。个人感觉,只要卖家靠谱、散热供电正常、不乱超显存,4080S 32G 魔改卡完全可以做本地大模型主力卡。
@Takano-RR 现在14600,涨了5000,有点不值得了
-
@Takano-RR 现在14600,涨了5000,有点不值得了
-
@stormaround 你在哪个平台买的4080s,魔改卡呢,我找找
@stormaround 你在哪个平台买的4080s,魔改卡呢,我找找
就是某宝买的,买的贵的14420快,改的三风扇
