京东自营上架二手3090,标价8699,近期有自建本地AI算力的玩家可以给东哥走个面,单卡或者双卡TP都很有CP值,比7900XTX新卡更好!
-
其实今天做了好几个视频,不知道先发哪个,因为有很多重要的话题值得谈。那么本期视频就是谈一谈京东上架自营拍拍二手3090的事情,售价大概是8700块钱,8699嘛。然后这个价格跟第三方店里面的7900 XTX是一个价格,就是新卡了。但是如果7900 XTX你在闲鱼上面买二手的话,大概5500块钱就能够买到。那我是建议,如果说你手头紧张的话,就去闲鱼淘二手的7900 XTX组双卡。我在上一个视频中其实也讲过双卡TP方案,但这个视频不知道是哪个先放出来,我一会儿再考虑一下。

论坛已经有人明确给出了使用7900 XTX来组双卡TP跑SGLang的方案,并且数据还相当不错。这个方案在本周还会继续完善,这个也是开源社区已经有人在用的方案。那么7900 XTX经过这一次补强,它就基本上没有什么缺点了。什么MiniMax H3、LTX 2.3或者说是Wan,在Ubuntu上跑得非常流畅。在Windows上,它有这个叫什么,机智Box,就是机智罗的盒子。以前它最大的短板就是不支持SGLang,因为这样在做Agent的时候,它这个长上下文会话,当然它现在llama.cpp单卡跑、单卡单会话的体验也是不错,但是毕竟大家都希望用多会话、长上下文,也不希望它长期以一种高负载的状态疯狂Prefill,每一轮对话都要做大量的预填充。尽管速度上可以接受,但是确实显卡负载特别高。那么现在有了SGLang方案,它最后一块短板也给补上去了。这么一万多块钱,7900 XTX双卡方案我觉得是非常值得的。
不过如果说你不愿意接受二手,不愿意在闲鱼冒险,你想要上新卡,那么新卡就算在拼夕夕上买,那也是7000大几到8000块钱这个价格,你才能买到新卡。而京东上比较靠谱的第三方店现在已经卖到8700了。在这种情况下,我就不建议你去折腾什么7900 XTX了,因为无论是单卡还是双卡TP,3090的方案毫无疑问是更强的。那么3090以前有一个什么问题呢?就是京东自营它不卖3090。你知道吗?这些3090的涡轮卡都是从第三方店买的。

讲实话,我在论坛中已经多次说过了,买魔改卡,无论是3090的涡轮卡,还是4080S 32G,或者说是我买的4090D 48G,只要你是魔改卡,我论坛中可以说10个人有8个人买到手之后都是坏了,要么退,要么换,要么修。就我本人在京东自营买的,它也坏掉了,但是我由于是半年之内坏掉了,给我直接换新,体验是非常好的,服务做得不错。但如果说你是在第三方店,我靠,这修一次给你修个把月、20天,你还要不要工作了?所以说这是3090最大的一个弱点。
而且3090要知道,它没有全新的卡,它所有的所谓新卡核心,都是从矿机上拆下来的,然后重新给你制板,对吧,移到新的PCB板上,然后重新贴片做SMT。这个过程中,尤其是给它加上涡轮散热、涡轮风扇,那么它的显存长期在高温底下工作。它虚焊的话,工艺哪怕有一点点问题,只要有哪个单个显存颗粒虚焊了,那可能整张卡就会挂掉。因为我之前出问题也是因为显存虚焊的问题。这个是魔改卡基本上难以避免的事情。你要么就买京东自营的,有3年质保,用起来才放心;要么就像我推荐的,你去买7900 XTX,因为它没有矿卡,就没有人用7900 XTX来挖矿。
但是由于二手东介入了这个战场,东哥虽然一毛钱都没有给我,但是我经常为东哥免费做广告,就是人家的服务做得确实非常不错。虽然经常把返修件当做新品卖给客户,我就遭遇过好几次。同一个SSD坏了,给我退了三次,都TM是坏的。结果最后他们自己都换得不好意思了,提出要退货我都不同意。我SSD以前买的时候是白菜价,现在你说退货,退我那点钱,我连一半的容量都买不到,你说我能同意吗?好在最后一次给我发的这个,我由于使用强度比较低,到现在还没有退。但是总体上,京东的服务是很好的,它只要愿意以自营的方式给你保一年,那我认为这就是当下最有性价比的AI解决方案。

你想吧,两张卡,3090它不是那种涡轮卡,不会说在高负载工作的时候嗡嗡作响,没有那么夸张的噪音。就像我这个4090D 48G,卧槽,那工作起来噪音真的是,也就我这种性子的人能够忍受得了,一般的人在旁边直接会炸掉。3090是正经的这种二手卡,而且是经过京东自检的。京东如果进行质量检测,那么它肯定是挑选品质比较好的,就问题不大。你那些什么暗病啊,什么东西都不用担心。关键是京东如果给你保一年,你就放心地用,这一年出问题了,京东一定会很快给你解决。拖时间长了,你去打电话骚扰他们就行了。比起一般的店来说,京东的服务你是可以完全放心的。
3090单卡,第一,它这个算力和带宽都比7900 XTX要更好。7900 XTX是数值上比3090更高,但是由于它生态的劣势,它实际的计算效能是不如3090的。第二,3090的生态,讲实话,它是所有的东西都是默认就能跑,这个卡没有什么硬性的缺点。我经常会喷一些图灵架构的卡,就是20系列的卡,什么RTX 8000这种老卡,或者说2080 Ti,我经常喷它们为工业垃圾,最主要的是因为它们不支持AI最主要的硬件指令集加速,比如说BF16,它们就不支持,它们只有FP16。这个在进行很多大模型推理的时候,效率是大打折扣的,而且现在很多新的架构、软件都不支持了。
但是你要知道,安培架构,3090跟A100是同代的,现在它的支持可以说是非常完善,几乎所有的主流开源架构、开源软件都支持。比如说我们最看重的AI大模型方面,llama.cpp、vLLM、SGLang,它都是完美支持。就交给你的AI,你把你的想法告诉它,要跑哪个模型,参数你都不用去考虑,AI Agent就能够帮你轻松搞定。然后到ComfyUI的领域,它在Windows上不需要像7900 XTX一样去下什么机智Box,它不需要。你就直接下官方标准的ComfyUI可移动版本,就是绿色版,它自己就能够跑起绝大部分工作流。如果说是在Linux底下,那它的生态就更好了。无论是单卡跑LTX 2.3、跑Wan,或者说跑MiniMax H3,或者说双卡TP跑SGLang、跑大模型,都非常不错。

而且现在就是说,ComfyUI它有了一个进步,就是有了很多种双卡同时工作的方案。比如说跑MiniMax H3的时候,让文本模型或者说其他的一些模型放到卡A中,然后把主模型或者VAE节点放到卡B中,这是一种拆分方式。另外一种就是说,现在比较流行的就是把两个显卡合并起来,显存池合并起来,但是它只能同时一张GPU在工作。但是我们知道,由于3090本身的基础算力非常不错,带宽也是接近1T的,所以说它即便是单卡工作,能形成48G的连续显存池的话,那它的效果还是非常好的。当然了,在ComfyUI上面,它这个双卡显存合并的方案到目前为止还不成熟,但是它也是一个解决方向。并且这个问题如果解决了的话,不仅是3090,7900 XTX的双卡方案也能够享受到这个红利,但是毫无疑问,3090享受的红利会更大。
当然了,我们需要知道,3090相比于7900 XTX,它是要落后一代的。7900 XTX跟4090基本上是属于同代的,它也支持什么INT4,支持什么FP8、INT8,3090好像都是不支持,这个我没有认真去查。就是它这块的指令集比7900 XTX是要差很远的。但是我们当下本地跑AI,用到最多的就是BF16、FP32,这个就是最最重要的,3090就是完美支持。

所以说,在京东出这个自营的二手3090 24G之后,我认为大家再去淘什么170HX,再去淘什么MI210,我觉得就完全没有什么性价比了。因为你们淘的那些东西都天生残疾,带有这样那样的硬伤,但是3090完全不需要你做任何额外的配置,你也不需要锁定驱动,也不要去魔改任何的软件。它绝大部分软件现在就是支持的,并且在未来一两年都看不到它被淘汰的可能,主流架构还是会支持它。
总之,我认为这是一个非常重要的信息,就是二手东它上什么东西,大家抓住就对了。之前它曾经上过4900的、带一年质保的7900 XTX,但是我没有去珍惜,当我失去它的时候,我才后悔莫及。如今我想组个双卡方案,要么去闲鱼淘个5500的,还有可能有风险的这种卡;要么我就只能花七八千去拼夕夕或者京东的第三方店中去买,那可能8500以上我才能买得到。有短期内搭建本地算力需求的,真的给东子走个面,这个广告我免费做了。
-
@terry 静音方面, 蓝宝石的7900xtx应该是无敌的存在吧. 就这一点, 完胜其它所有卡, 哈哈. 我在闲鱼上买的第二块7900xtx也到了...
-
给近期想买3090显卡的兄弟们提个醒,3090在PCB背面放了12颗GDDR6X显存,仅靠背板被动散热。高负载下温度轻易突破100℃,长期高温会加速老化虚焊,导致花屏或直接点不亮。特别是想上双卡跑大模型的一定要注意散热,论坛中有个大神提议的开放式机箱,加显卡背对背放的方案不错,值得参考。
-
真没想到
才过3个月 显卡 从6000 冲上1万想当初卖家卖我7200 我都觉得他坑我
-
真没想到
才过3个月 显卡 从6000 冲上1万想当初卖家卖我7200 我都觉得他坑我
@applejuice 想当初我5150买的 3090, 现在想想应该感谢当时的自己, 但是也遗憾没有买两块
-
@neo 赶紧下手, 下一个涨价的就是3080 了
-
@johnnybegood 现在已经是双3080了,可惜主板不能插3张,不然倒想试试,现在即使4张3080也才一张4080S的价格。
-
给近期想买3090显卡的兄弟们提个醒,3090在PCB背面放了12颗GDDR6X显存,仅靠背板被动散热。高负载下温度轻易突破100℃,长期高温会加速老化虚焊,导致花屏或直接点不亮。特别是想上双卡跑大模型的一定要注意散热,论坛中有个大神提议的开放式机箱,加显卡背对背放的方案不错,值得参考。
@freeman-gemmy 是有点热,所以我在tb买了超薄(13mm吧)带风扇散热,希望有点帮助
-
你这情况分两种目的,结论不一样,先说清楚:
1. 只想跑两个"各自独立"的模型实例(一张卡跑一个大模型,各管各的)
那 X99-TF 单 x16 完全够。PCIe 只影响启动时把权重加载进显存那一下,加载完进入跑分阶段就是 GPU 自身算力 + 显存带宽在干活,和 PCIe 没关系。第二张卡插到芯片组(PCH)给的槽上,PCIe 3.0 x4 左右,加载慢个几十秒,稳跑起来没问题。老特说的"有 SGLang 问题不大"就是这个意思——它只是加载/offload 路径,不是 decode 路径。2. 想一张卡做 TP(tensor parallel),把一个大模型拆到两卡上
这时候 PCIe 就是硬瓶颈了。每层计算完要把中间结果通过 PCIe 传给下一卡,第二张卡若在芯片组 x4 槽,等于每次前向都在 x4 上过一遍,decode 会掉得很难看。要跑正宗的 TP,得两块卡都走 CPU 直连的 x16/x8(x8+x8 也行),而且最好开 P2P。X99-TF 这种单路板给不出第二条 CPU 直连 x16。如果你要的是第 2 种,几条路:
- 换支持 x8/x8 拆分的单路 X99(比如 X99-AD4 这类),E5-2686v4 配着用,便宜。
- 或者上双路 X99 板,CPU 直连槽位多,两个 x16 都走 CPU。
- 但注意:RDNA 显卡在 vLLM 上本来就没有官方 TP 支持(得用 JartX 那种 fork 自己打通 RCCL),llama.cpp Vulkan 的 tensor-split 倒是能跑,吃的是容量不是速度。
另外补一句:X99 平台通常没有 ReBAR 选项,这是正常的,而且 ReBAR 对推理根本没有影响,别为了它换板。
一句总结:纯跑两个实例 → X99-TF 单 x16 能用,别折腾;想单模型双卡 TP → 必须双 CPU 直连 x16,X99-TF 给不出来。
-
@neo 3080的问题是不能跑comfyui,其他的,你要多个3.0 x16或者4.0 x 8的PICE接口,这个板U不会便宜,不过肯定比买4080S跑大模型划算。开放式机架可以解决。
