现在想买一张新卡跑qwen3.8 27b, 预算1w左右
-
现在手上有张6900xt,但感觉太慢了。
目前想买ai pro r9700,不知道有没有更好的选择?
还有就是fp8有没有必要,希望可以战未来。
希望大家给点建议。跑 27B 选 R9700 32G 方向没问题,补几点可验证的判断:
- 27B Q4_K_M 约 16–18G,32G 能留 10G+ 给 KV,长 ctx / 多并发才够;16G 或 24G 的卡会先卡在显存。
- FP8 对 27B 单卡意义有限:FP8 权重就约 27G,加 KV 基本顶到 32G,实际还是 Q4/Q5 + FP16 KV 更实用。RDNA4 的 FP8 更多是给以后更大的模型 / 更高吞吐留路。
- 战未来这点 R9700 赢在软件栈:gfx1201 + ROCm 7.x + SGLang/HIP 都跟上了;7900XTX 是 RDNA3、无 FP8,SGLang 支持也不如 RDNA4。
- 代价是 ROCm 生态比 CUDA 新,踩坑排查成本高;纯 llama.cpp HIP 已经可用。相对 6900XT,R9700 是带宽 640 vs 512 GB/s、显存翻倍、ROCm 支持正常,单卡 27B 的提升是实打实的。
-
跑 27B 选 R9700 32G 方向没问题,补几点可验证的判断:
- 27B Q4_K_M 约 16–18G,32G 能留 10G+ 给 KV,长 ctx / 多并发才够;16G 或 24G 的卡会先卡在显存。
- FP8 对 27B 单卡意义有限:FP8 权重就约 27G,加 KV 基本顶到 32G,实际还是 Q4/Q5 + FP16 KV 更实用。RDNA4 的 FP8 更多是给以后更大的模型 / 更高吞吐留路。
- 战未来这点 R9700 赢在软件栈:gfx1201 + ROCm 7.x + SGLang/HIP 都跟上了;7900XTX 是 RDNA3、无 FP8,SGLang 支持也不如 RDNA4。
- 代价是 ROCm 生态比 CUDA 新,踩坑排查成本高;纯 llama.cpp HIP 已经可用。相对 6900XT,R9700 是带宽 640 vs 512 GB/s、显存翻倍、ROCm 支持正常,单卡 27B 的提升是实打实的。
@Xiaote 感谢补充信息!我相信过两年amd会自己长出cuda的w
-
@Xiaote 感谢补充信息!我相信过两年amd会自己长出cuda的w
-
锤锤不是一直都在推荐 7900XTX 么
-
看视频或帖子了吗?双卡 sglang。
-
还有人用两台 mac mini 24G联机跑 Qwen3.8 27B 差不多也是一万出头
-
刚刚买R9700 ,有点吵。

-
看视频或帖子了吗?双卡 sglang。
@williamlouis 看到过贴子,没看到视频,但我记得双卡sglang的速度也不是很高,跟vllm单卡的速度差不多。
-
RDNA2 沒有WMMA加速器 會退回到ALU運算
-
1W 太少了。不如订阅了。
-
锤锤不是一直都在推荐 7900XTX 么
@Alexander-Lee 7900XTX 蓝宝石的做工确实没得说,单卡我也想买一张。但是如果双卡跑模型,7900XTX并不合适,主要的问题,不是RDNA3,也不是显卡,是尺寸。太特么厚了。一张卡 整整占了7CM厚度。
-
刚刚买R9700 ,有点吵。

@lesslin-xiu 你这个上下文是多大的?我也想买一张。
-
看视频或帖子了吗?双卡 sglang。
@williamlouis
你们都不看规格的吗?这么厚的卡?怎么玩两张,这怎么可能是个长期方案?

