MiniMax-H3-PRO6000-vs-DGX-Spark-速度对比
-
今天做同一个任务,分别用两套硬件跑了一下:
任务内容:MiniMax H3 的视频生视频工作流( ComfyUI)。相同同参——960×544 pass1 → 3D latent 2.0× + refine → 1920×1088,LoRA 0.3,12 steps。实测显存占用大约 ~67–69GB
硬件 结果 RTX PRO 6000(SM120,96GB)
90帧 ≈ 10.4 min;124帧 ≈ 17.9 min;158帧 ≈ 27.0 minDGX Spark ×1(GB10,128GB 统一内存)
同工作流大约 3.2×–3.5× 更慢:90帧 ≈ 36.3 min;124帧 ≈ 61.1 min;158帧 ≈ 86 min换算成吞吐:单台 Spark ≈ 一张 PRO 6000 的 29%–32%。差距挺明显的。
价格粗比(估算价格)
硬件 计价 容量 相对本帖吞吐 DGX Spark 3.4 万 / 台 128GB 统一 ≈ PRO 的 30% / 台 RTX PRO 6000 max-q 15 万 / 整机 96GB GDDR7 100% 基线 粗算(只谈「能跑这条图」):
- 1× PRO = 15 万 → 单条最快
- 1× Spark = 3.4 万 → 约 30% 速度;单价是 PRO 的 22.7%(3.4/15),比吞吐比例还便宜一点
- 4× Spark = 13.6 万 → 比一张 PRO 还少花 1.4 万,整批并行粗算约 1.2× 一张 PRO 串行产能
所以成本上:四台 Spark 打包 略便宜于 一张 PRO,换的是并行海选产能。单条要快回看, PRO 6000 仍然值。
用下来总体感受:
- 单条速度:PRO 明显更快。 不是理论峰值,是总体任务墙钟。同样输入同样图,Spark 慢一倍以上很常见,今天对齐后更接近 慢到约 3.3 倍。
- 四台 Spark 并行 约等于 一张 PRO 6000。 粗算
4 × 30% ≈ 1.2,整批产能才勉强略超一张 PRO 串行 - Spark 的价值更像产能形态 + 大内存,不是单卡秒速。 多候选海选、能等 30–90 分钟/条、要统一内存容量时,四机并跑有用;改一版就要立刻回看,还是 PRO 更合适。
- 功耗/温度也摸了一下。 负载时 Spark 单机大约 80–95 W,SoC 常到 90–95°C(看 SoC,不只看 GPU;本机温度墙约 104.8°C)。PRO 出片直接 顶满 300 W,GPU ~80°C。我们这边两两 3D 打印堆叠,前猫头鹰进气、后创客星系 Pro 120 排气:双负载堆叠能稳住 ~92°C。
- 在 480p 工作流下, Spark 大概在 PRO 的 33%–46%。分辨率上去以后,差距被放大了。
有没有跑过 H3 / 同类视频工作流的 PRO 6000 vs Spark 对比?欢迎点评、讨论。
-
坐等 rtx Spark...