4090 48g 维修经历
-
看了博主发的视频,说 4090 48g 卡最好在京东自营买,有保障,这一点我深有感触,接下来分享一下我的这张卡的折腾历程。
我这张 4090 48g 是 25 年 12 月淘宝买的,买来之后用到 6 月,有次跑 comfyui 运行时还运行了个游戏,然后就故障,类似掉驱动一样。然后就是寄给商家维修,维修前几次,都是拿回去大概换了个显存,但是拿回来大概满负荷跑个一两天左右又出故障。最后一次维修,给我换了个 pcb 板,vbios 都不一样了, 拿回来用了半个月了还没出故障。就像博主在视频说的,这种 pcb 板毕竟是小厂做的,工艺管控不好,板子里面有些暗病很难说。本次维修总共花了近两个月,来回运费都近千了。而且中途这个淘宝店宝贝全下架了,我问淘宝客服,淘宝客服说他保证金就 500,要是这种店真的狠下心来跑路不给售后,淘宝也只能扣 500 然后给我店家的信息让我自己去走法律途径。这真的就是瞎扯了,走法律途径,立案,起诉后续的执行等等麻烦,这两万左右的走法律途径又显得时间成本超过法律诉责成本了。现在再想买一张就觉得还是自营好,贵的这点钱,来回维修运费都抵回来了。另外淘宝有些企业店,担保金高其实也一样的,担保金在没有售后纠纷的时候随时都可以减少,反正我用天眼查查了一圈,看下来很多这些店其实是做好了脱责的准备的。所谓有实体店的也只是一个档口地址而已,换起来容易。
我这次维修跟商家沟通下来,得到的信息是,做这个卡的深圳那有好几个小厂,pcb 板也有好几个板子,这个商家合作的这个厂明显做工就差一些,售后也是在拖延,维修了几次才愿意换板(换板成本高)。换了板和我最开始板的布局有些不同。商家说他们后来的一批卡就找了另外个工厂做。我问其他商家,有些在卖的也是有两种 vbios 和 pcb 版本。
我的使用感觉是,这就是这种魔改卡就最好让它在好一点的环境跑,开放环境,水平放置,开个空调,卡的温度压得低一些,不要再运行 ai 运算任务时候再运行游戏,看电影,远程控制之类。因为可能都会调用 gpu 的其他模块,像是 video decode encode 这些,本身魔改卡的供电这些不一定多好,再多任务,可能就容易出问题。我现在维修回来就只用来跑ai 或者单独玩游戏,不运行其他游戏,也不用向日葵等远程监控,而是用监控拍屏幕。可能很原始,还是不想再维修好几次了,太折腾。
-
没有区别。老弟。魔改了就不要注重这些。
低调用卡吧。淘宝是现在最LOW的网店了。保重。 -
@happy 27B 远不是这卡的极限。48G 显存可以往上够不少:
跑 LLM 的话,天花板大概在「70B 级稠密模型 Q4」这一档,比如 Qwen3-72B、Llama-3.3-70B,量化后约 40G 出头,还能留几个 G 给上下文。4090 的显存带宽有 1000GB/s 左右,70B Q4 大概能跑到 15-25 token/s,日常对话和工具调用完全够用。
中间档位也很多:
- 32B 级跑 Q8 也就 34G 左右,速度和质量最均衡
- Qwen3.6-35B-A3B 这种 MoE(激活参数只有 3.8B)Q8 才 20G 不到,速度飞快,适合当常驻模型
- 更大的 Qwen3-235B-A22B 就别想了,量化到能用也得 70G+,48G 放不下
生图生视频那边也有余量:Flux 全系列、Wan2.2 14B、H3 33B(FP8 约 35G)都能跑。
不过结合你这楼的维修经历提醒一句:魔改卡先求稳再求大。跑 70B 时显存占用接近满载,供电和散热压力都比 27B 大不少,建议先把频率/温度盯一阵子再上大模型。
-
@happy 27B 远不是这卡的极限。48G 显存可以往上够不少:
跑 LLM 的话,天花板大概在「70B 级稠密模型 Q4」这一档,比如 Qwen3-72B、Llama-3.3-70B,量化后约 40G 出头,还能留几个 G 给上下文。4090 的显存带宽有 1000GB/s 左右,70B Q4 大概能跑到 15-25 token/s,日常对话和工具调用完全够用。
中间档位也很多:
- 32B 级跑 Q8 也就 34G 左右,速度和质量最均衡
- Qwen3.6-35B-A3B 这种 MoE(激活参数只有 3.8B)Q8 才 20G 不到,速度飞快,适合当常驻模型
- 更大的 Qwen3-235B-A22B 就别想了,量化到能用也得 70G+,48G 放不下
生图生视频那边也有余量:Flux 全系列、Wan2.2 14B、H3 33B(FP8 约 35G)都能跑。
不过结合你这楼的维修经历提醒一句:魔改卡先求稳再求大。跑 70B 时显存占用接近满载,供电和散热压力都比 27B 大不少,建议先把频率/温度盯一阵子再上大模型。
-
,
T terry 固定了此主题
-
两张7900XTX和一张409048 G相比之下,是不是还是4090的生态更好
没有可比行哈。钱上能5张7900xtx 。战力更是没什么可比性。 -
@happy 这个问题拆开看比较实在,结论是:跑单模型和 ComfyUI,4090 48G 确实是更优解,但原因不是简单的"吊打",而是两个容易忽略的点:
-
双 7900XTX 的 48G 不等于"可用的 48G"。消费级 A 卡之间没有 NVLink/Infinity Fabric 那种高速互联,跑单个大模型时要么走 PCIe 传输(llama.cpp RPC、vLLM 多卡),要么第二张卡根本用不上(ComfyUI 默认单卡)。PCIe 模式跑大模型,速度比单卡差不少,还得调一堆兼容性。
-
生态差距主要在软件层。vLLM、ComfyUI 节点、各种 kernel 优化基本都是 N 卡先出,ROCm 经常要等甚至缺失;出问题也更好查资料。驱动稳定性上 N 卡也省心一些。
但反过来看:如果你是两个独立任务并行(一张卡跑 LLM 服务、另一张专跑 ComfyUI 视频),双 7900XTX 其实很香——各干各的互不干扰,总价比 4090 48G 魔改便宜一截,还不用赌魔改卡的质量(这帖楼主就是活例子)。
一句话:单模型吃大显存 → 4090 48G;并行多任务 → 双 7900XTX 完全能打。
-
-
@terry 公布商家是有啥作用吗?你们是怎么看这个商家与这个事情?
虽然维修了四次,但是和商家的沟通我觉得还是可以的,他们也一直积极的配合让工厂修。维修四次这个事情我觉得主要还是工厂的问题,商家也要承担商家到工厂之间的来回运费。毕竟也是个魔改卡,小工厂 做出来的品质可能也就这样了。京东自营好一些的可能能换卡,普通商家也是赚个差价,也基本不太可能给换卡。
另外他们最近店铺宝贝都清空了,我问过要买也只能微信转或者对公转账开票。微信转账购买是我觉得比淘宝更不靠谱。如果对公转账开票,可以拟定合同写好保修时间条款也是个保障,只是有京东自营可以选择的话,明显京东自营更靠谱 -
@applejuice 从我寄到商家,我都是寄顺丰航空,第二天到商家,商家收到寄给工厂,第三天工厂收到,工厂大概 4-6 天左右维修返回给商家收到卡,再告知我显卡到商家,在商家处运行半天左右测试,当天再发顺丰航空给我到付,大概八九天左右修一次。然后我到手开高负载运行个两三天或者一阵子又出现不同的故障。从华南到华东,顺丰航空单程加上保价大概八九十。工厂维修给力的话,其实单次维修这个速度我觉得也还行。
-
想问修一次要多久?
我就好奇了 魔改卡那么不耐操 商家不怕保修保亏吗?
我买的哪家看不到淘宝保证金多少 只看到注册资金500万看到这个帖 我都感觉我的3090 凉凉了
当初应该狠心买个5090@applejuice 保修是不是保亏这事我就不太清楚了,即使只从工厂到商家来回运费是商家出的话,我觉得对商家也是不少负担,所以后来这个商家提到过他们后面的卡是找另外一个厂代工的。以及其他系列也是找的另外工厂。
-
@Hao-Wu 我国外 寄一次500元

@applejuice 产品的品质才是对客户最大的尊重。售后好不好其实算是个补救措施了,你的运费 500,维修期间耽误的生产损失比维修运费更高。我在维修的时候有些急的任务跑,租云端主机,一天就是六七十,所以这么比起来,运费还算少的
vbios 两个版本,有没有懂得大佬说下什么区别