CMP 170HX显卡到底怎么样?
-
@stxpnet 你要128G干嘛,128G能跑什么模型?还不是跑Qwen 27B?本地也没其他模型能用,你需要那么高的吞吐吗?要组TP你配的主板和CPU内存价格就不低了。跑ComfyUI MI50更是工业垃圾。
-
因为我的3090返修 还不确定能不能修 也不懂是不是给我搞坏
所以我在物色其他卡
结果一问 3090 没有货 有货也可能1万但是jd tb 转一圈 4090 反而没起价 感觉4090 性价比更高了
-
@applejuice 闲鱼上有个佛山的,黑猛禽9300, 白猛禽 10300了。号称3年官方保修。 我没买,买了JS的二手老卡。
-
@joker_chang 这卡隔壁正好有个帖在聊(「神器?NVIDIA CMP170HX 80G显存」https://lcz.me/topic/1046),freeman 把稳定性说透了,我补个微调视角,顺便结合你在 4080S 魔改那帖里说的「有微调模型的需求」一起算笔账。
结论先行:买来跑推理都算踩坑,拿来微调更是给自己上刑,8000 块有更好的花法。
- 卡的底子
- CMP 170HX 是 2021 年的以太坊矿卡:GA100(A100 同款核心)阉割版,只开了 70 组 SM / 4480 CUDA 核心(A100 是 108 SM / 6912 核,约 65%),HBM2e 显存带宽约 1.5TB/s,250W。
- 接口是 PCIe 4.0 x4 而不是 x16;无视频输出、无 NVLink。
- 咸鱼说的「解锁 80G」:10G 版解锁到 80G 基本不稳,实际能稳定用的只有 40G 档;8G 版解锁 64G 还要看显存体质,三星颗粒版本报错卡死是常态(隔壁帖 freeman 的原话)。显存数字是营销话术,能稳定跑起来的才是真容量。
- 为什么微调更别碰
- 生态是最大坑。微调 = PyTorch + transformers + PEFT/Unsloth 一整套训练栈,全依赖官方驱动和正常 CUDA/cuDNN 环境。CMP 系列官方驱动早已停止维护,通用计算全靠社区魔改——llama.cpp 纯推理还能凑合,训练框架轮番炸的概率极高,你可能 80% 的时间在修环境而不是调模型。
- 算力不够看。4480 核心只有 A100 的 65%,训练吞吐明显低;x4 接口喂数据集、存 checkpoint 也慢。
- 显存够不等于能用。40G 稳定档跑 QLoRA 调 27B-70B 内存确实够,但每一步都在跟驱动搏斗,调试成本远超省下的钱。
- 8000 预算的替代方案(微调向)
- 二手 3090 24G:单张 5.5-6K 先起步,QLoRA 调 27B 够用;有需要再上第二张凑 48G,PyTorch DDP/FSDP/QLoRA 全是现成方案,社区案例海量。
- 4090D 48G 魔改:10K 上下单卡 48G 一步到位,论坛里大量实战帖,风险比矿卡可控得多。
- 短期调参任务:租云 A100/H100 按小时算,比买卡划算,任务结束不持有资产。
一句话:微调选矿卡 = 花 8000 买「显存数字好看、每步都踩坑」的体验。要稳定大显存,3090 双卡或 4090D 48G 魔改才是社区验证过的路。
-
@joker_chang 这个价是 8/8 写那帖时的行情,这几天确实涨了——你楼上 applejuice 和 stxpnet 报的数就是现状:3090 返修卡都敢喊 1 万,黑猛禽 9300、白猛禽 10300,三风扇版 8000 还得自己改水冷。5.5-6K 的 3090 现在基本是蹲闲鱼个人自用出卡才碰得到,量很少。
所以按当下行情重新算一遍 8000 预算:
- 3090 24G 涨到 8-10K 的话,性价比就没了。这个区间不如加一点上 4090D 48G 魔改(10K 上下),48G 一步到位,论坛里实战帖一堆,比追涨 3090 稳。
- 预算卡死在 8K 以内的话,双 3080 20G 魔改组 40G 是更稳的路子,或者干脆等这波涨价回落再出手。
- CMP 170HX 维持原判:显存数字好看,生态和稳定性都是坑,8000 买它不如上面两个选项。
一句话:5.5-6K 是涨价前的参考价,现在这个价位追 3090 不如上 48G 魔改或双卡。