@terry 闲鱼上有,最低1.18万,1.288万和1.3万,我差点就买了,我让chatgpt分析对比了一整天,说是社区有反应说生成马赛克和图片模糊,让我很纠结,r9700这几天跑刘悦minimax H3windows整合包,5秒文生视频二次超分768*1376在200秒左右
P
passss
@passss
-
主要玩comfyui跑minimax-h3,想把手上的7900XTX换成R9700可行吗? -
二张3090通过nvlink跑大模型,有人尝试过吗?x99,ddr3-32g 2080ti22g+11g+nvlink, Qwen3.8 27B Q4_K_P、128K Q8 KV、embedded MTP
已启用 llama.cpp 的 NVLink P2P 直接交换模式。验证结果:
-
MTP 服务已重启,PID:114030
-
进程环境:GGML_CUDA_P2P=1
-
GPU0
GPU1 P2P 读写:均为 OK -
双卡显存占用:
- GPU0:7750 MiB
- GPU1:14524 MiB
-
Q8 KV、思考模式、MTP 推测解码及 1,2 分层比例保持不变
-
实际推理请求成功,约 38.7 token/s
-
-
主要玩comfyui跑minimax-h3,想把手上的7900XTX换成R9700可行吗?我现在也在用r9700,H3跑起来慢一点但没问题,我在想换w7900是不是会更好一点?毕竟48g显存,带宽也高40%,二手价格13000相对r9700不算贵,唯一担心的就是会不会出现社区说的出现马赛克等bug…
-
MiniMax H3 本地视频生成经验分享(AMD RX7900XTX)我一直在纠结w7900能不能替代r9700
-
双3090 + Ollama 加载 Q8 视觉模型瞬间断电重启,求老哥们把脉@Leon-Y 我也双3090,用海盗船hx1200电源单路,lm studio,用qwen27b-mpt-q4,也是瞬时断电重启,现在限制到250W,用Q8非mtp模型128k上下文,25tps,q4模型37tps,比大多数人慢很多。
-
洋垃圾的回乡路 —— 2x3090 + X99 + 2x2680v4@Ray-Wang 谢谢兄弟,我今天让codex监控运行qwen 27b,得到的回答是:当限制到250w,瞬时峰值在378w和345w,如果按超龙和猛禽的最大功率480+450推算两卡总峰值会上1100+,推测用mtp模型显卡同时并发的次数会更多,我也不敢试了,看来限制功率是非常必要的。
-
洋垃圾的回乡路 —— 2x3090 + X99 + 2x2680v4楼主双3090用多大的电源?我1200W跑27b-mtp不限制到300W以下就要重启