【避坑指南】CMP 170HX 是一张完全不值得推荐的卡。没买的就不要入坑了。
-
避坑总结:卡商不是傻子。如果有不得不入手的理由请详细考虑。本人判断是个坑。炒作已经是个定论了。N年前新卡100U,淘汰后卖2000U。请尊重自己的脑子!
上数据:项目 解锁后状态 说明 显存 64 GB HBM2e(8GB 版 Hynix 颗粒) 软件解锁,无需硬件改动 算力 FP16 ~164 TFLOPS / BF16 ~174 TFLOPS 约 A100 的 85%,Tensor Core 正常工作 FP32 ~12.2 TFLOPS 解锁前被 cripple 到几乎不能用 FP64 ~6.5–11.6 TFLOPS 完整 1:2 比例,没砍 显存带宽 ~1263–1600 GB/s 实测,接近 A100 水平 PCIe Gen2 x4(软件)/ Gen1 x16(需焊电容) 原始被锁 Gen1 x4,软件可升到 Gen2 x4;要 x16 需硬件改电容 ECC
无法开启硬件有,但 GSP 不启动,长期推理有风险 NVLink
完全没有多卡 tensor parallel 基本不可行 关键限制与风险
体质抽奖
8GB Hynix 版解锁 64GB 相对稳定,但 10GB Samsung 版解锁 80GB 普遍不稳定,40GB 才是安全线 。NVIDIA 当初屏蔽显存可能不只是市场分割,也可能是颗粒本身有缺陷。
PCIe 瓶颈
即使解锁后也只有 Gen2 x4(~2 GB/s),加载 64GB 模型权重要等几十秒。如果你频繁换模型或做流式处理,体验很差。焊电容改 x16 可以提升到 ~4 GB/s,但信号仍是 Gen1,且需要动手能力 。
被动散热
没有风扇,必须放在有前后风道的服务器机箱里,家用机箱直接过热降频。
无显示输出
纯计算卡,需要另备亮机卡或核显。
INT8 仍被锁
虽然 FP16/BF16 算力完全释放,但 INT8 推理路径似乎还有限制,比 FP16 慢 3.7 倍 。
价格暴涨
解锁工具放出前这张卡只要 $100–200,现在已经炒到 $1000–2000+,性价比在快速稀释 。极尽于无的性价比! -
,
T terry 固定了此主题
-
@kos-or 老弟不要侮辱赌石。赌石有暴富的可能。你有可能买到真有玉石的概率。这玩意儿 连工业垃圾 都不算。他的参数决定了这个卡的体质低于工业垃圾。
-
格不配位 降到500我還是稱它神卡
-
看来我算是赌对的那个。买之前卡商给了个链接,我让 codex 远程跑了两个小时,能验证的都验证了。确认没问题记录显卡 id,收到货后验证了也没啥问题。确实 qwen3.8 27b 用sglang 部署的 w8a16 的 262k 上下文,dflash2,32k 一下输入都在 100t/s,200k 以上 掉到 60t/s。当然我是 8500 买的,过一个礼拜 同一个商家直接涨到 12500。我觉得 8500 还能买来玩玩,12500 就太扯了。qwen3.8 flash 也测了,1k 输入在 26t/s,27k 就掉到 20 t/s 了,到 200k 以上就剩 16t/s 了。decode 还好,主要是 prefill 太慢,200k 测试 prefill 有十几分钟。现在用他在 vllm 下面部署了 ornith1.5,10 并发。单路 196t/s,10 并发能到 740t/s。所有的部署都是让 codex 完成的。
-
看来我算是赌对的那个。买之前卡商给了个链接,我让 codex 远程跑了两个小时,能验证的都验证了。确认没问题记录显卡 id,收到货后验证了也没啥问题。确实 qwen3.8 27b 用sglang 部署的 w8a16 的 262k 上下文,dflash2,32k 一下输入都在 100t/s,200k 以上 掉到 60t/s。当然我是 8500 买的,过一个礼拜 同一个商家直接涨到 12500。我觉得 8500 还能买来玩玩,12500 就太扯了。qwen3.8 flash 也测了,1k 输入在 26t/s,27k 就掉到 20 t/s 了,到 200k 以上就剩 16t/s 了。decode 还好,主要是 prefill 太慢,200k 测试 prefill 有十几分钟。现在用他在 vllm 下面部署了 ornith1.5,10 并发。单路 196t/s,10 并发能到 740t/s。所有的部署都是让 codex 完成的。
-
我还有个 3090ti,2 个月前 6200 买的,现在一看都 9000 左右了。正好看到 170hx 的解锁技术也稳定了,跟 chatgpt 讨论了半天,他建议我买来试试,前提是买前由他来远程测试。
-
看来我算是赌对的那个。买之前卡商给了个链接,我让 codex 远程跑了两个小时,能验证的都验证了。确认没问题记录显卡 id,收到货后验证了也没啥问题。确实 qwen3.8 27b 用sglang 部署的 w8a16 的 262k 上下文,dflash2,32k 一下输入都在 100t/s,200k 以上 掉到 60t/s。当然我是 8500 买的,过一个礼拜 同一个商家直接涨到 12500。我觉得 8500 还能买来玩玩,12500 就太扯了。qwen3.8 flash 也测了,1k 输入在 26t/s,27k 就掉到 20 t/s 了,到 200k 以上就剩 16t/s 了。decode 还好,主要是 prefill 太慢,200k 测试 prefill 有十几分钟。现在用他在 vllm 下面部署了 ornith1.5,10 并发。单路 196t/s,10 并发能到 740t/s。所有的部署都是让 codex 完成的。
看来我算是赌对的那个。买之前卡商给了个链接,我让 codex 远程跑了两个小时,能验证的都验证了。确认没问题记录显卡 id,收到货后验证了也没啥问题。确实 qwen3.8 27b 用sglang 部署的 w8a16 的 262k 上下文,dflash2,32k 一下输入都在 100t/s,200k 以上 掉到 60t/s。当然我是 8500 买的,过一个礼拜 同一个商家直接涨到 12500。我觉得 8500 还能买来玩玩,12500 就太扯了。qwen3.8 flash 也测了,1k 输入在 26t/s,27k 就掉到 20 t/s 了,到 200k 以上就剩 16t/s 了。decode 还好,主要是 prefill 太慢,200k 测试 prefill 有十几分钟。现在用他在 vllm 下面部署了 ornith1.5,10 并发。单路 196t/s,10 并发能到 740t/s。所有的部署都是让 codex 完成的。
我现在也不知道 mac 跑大模型(M5 max 128g 跑个70B),长上下文到底能掉到多少。
-
就离谱了,我闲鱼买170hx 那家店价格涨到 15800 了。一周时间翻了快一倍!后来知道有人 4 卡跑 deepseek v4 flash 了,速度还不错。还有人 8 卡跑 glm5.3 了,好像速度能到 30t/s。
-
就离谱了,我闲鱼买170hx 那家店价格涨到 15800 了。一周时间翻了快一倍!后来知道有人 4 卡跑 deepseek v4 flash 了,速度还不错。还有人 8 卡跑 glm5.3 了,好像速度能到 30t/s。
@cool-zero 就按现在这个价格, 真的被 M5Ultra studio 完爆了。 每块16000, 四块 64000, 现在 256G 的 m5ultra studio 才7w多。当然话说回来, 如果当初能1000块钱以内囤个8张, 也还算是有性价比的。
