跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

Rex FanR

Rex Fan

@Rex Fan
取消关注 关注
关于
帖子
7
主题
1
分享
0
群组
0
粉丝
0
关注
0

帖子

最新 最佳 有争议的

  • 公司有LLM做数据清洗和视频生成需求,求大神分析配置
    Rex FanR Rex Fan

    @Jake-Kwoh 你做的视频分辨率是多少?DeepSeek 和Qwen 会有多少人用,并发希望做到多少tps?Minimax H3 和 LLM 的权重需要一起载入显存么?

    AI硬件 视频生成 rtx5090 deepseek

  • 4090 48g 维修经历
    Rex FanR Rex Fan

    @张光璞 pro5000在 deepseek 和 minimax 开源之后都涨了近2w

    AI硬件 rtx4090

  • MiniMax-H3-PRO6000-vs-DGX-Spark-速度对比
    Rex FanR Rex Fan

    @kop-wang 是的, 不过现在spark还没怎么涨价,相对划算

    AI音视频画图 minimax rtxpro6000 dgxspark

  • MiniMax-H3-PRO6000-vs-DGX-Spark-速度对比
    Rex FanR Rex Fan

    今天做同一个任务,分别用两套硬件跑了一下:

    任务内容:MiniMax H3 的视频生视频工作流( ComfyUI)。相同同参——960×544 pass1 → 3D latent 2.0× + refine → 1920×1088,LoRA 0.3,12 steps。实测显存占用大约 ~67–69GB

    硬件 结果
    RTX PRO 6000(SM120,96GB) ✅ 90帧 ≈ 10.4 min;124帧 ≈ 17.9 min;158帧 ≈ 27.0 min
    DGX Spark ×1(GB10,128GB 统一内存) ✅ 同工作流大约 3.2×–3.5× 更慢:90帧 ≈ 36.3 min;124帧 ≈ 61.1 min;158帧 ≈ 86 min

    换算成吞吐:单台 Spark ≈ 一张 PRO 6000 的 29%–32%。差距挺明显的。

    价格粗比(估算价格)

    硬件 计价 容量 相对本帖吞吐
    DGX Spark 3.4 万 / 台 128GB 统一 ≈ PRO 的 30% / 台
    RTX PRO 6000 max-q 15 万 / 整机 96GB GDDR7 100% 基线

    粗算(只谈「能跑这条图」):

    • 1× PRO = 15 万 → 单条最快
    • 1× Spark = 3.4 万 → 约 30% 速度;单价是 PRO 的 22.7%(3.4/15),比吞吐比例还便宜一点
    • 4× Spark = 13.6 万 → 比一张 PRO 还少花 1.4 万,整批并行粗算约 1.2× 一张 PRO 串行产能

    所以成本上:四台 Spark 打包 略便宜于 一张 PRO,换的是并行海选产能。单条要快回看, PRO 6000 仍然值。

    用下来总体感受:

    1. 单条速度:PRO 明显更快。 不是理论峰值,是总体任务墙钟。同样输入同样图,Spark 慢一倍以上很常见,今天对齐后更接近 慢到约 3.3 倍。
    2. 四台 Spark 并行 约等于 一张 PRO 6000。 粗算 4 × 30% ≈ 1.2,整批产能才勉强略超一张 PRO 串行
    3. Spark 的价值更像产能形态 + 大内存,不是单卡秒速。 多候选海选、能等 30–90 分钟/条、要统一内存容量时,四机并跑有用;改一版就要立刻回看,还是 PRO 更合适。
    4. 功耗/温度也摸了一下。 负载时 Spark 单机大约 80–95 W,SoC 常到 90–95°C(看 SoC,不只看 GPU;本机温度墙约 104.8°C)。PRO 出片直接 顶满 300 W,GPU ~80°C。我们这边两两 3D 打印堆叠,前猫头鹰进气、后创客星系 Pro 120 排气:双负载堆叠能稳住 ~92°C。
    5. 在 480p 工作流下, Spark 大概在 PRO 的 33%–46%。分辨率上去以后,差距被放大了。

    有没有跑过 H3 / 同类视频工作流的 PRO 6000 vs Spark 对比?欢迎点评、讨论。

    AI音视频画图 minimax rtxpro6000 dgxspark

  • DGX单机也有春天——Qwen3.8-27B at 34-38 tok/s on DGX Spark (GB10) — one-command SGLang + NVFP4 + DSpark
    Rex FanR Rex Fan

    @terry x上 dgx spark 的开源氛围还是蛮好的,有好几个博主在做调优,通常一周内会出一个非常可用的版本。我用的是这个仓库的配方: https://github.com/MiaAI-Lab/DeepSeek-v4-Flash-DSpark-2x-DGX-Spark

    LLM讨论区 dgxspark qwen-27b gb10

  • DGX单机也有春天——Qwen3.8-27B at 34-38 tok/s on DGX Spark (GB10) — one-command SGLang + NVFP4 + DSpark
    Rex FanR Rex Fan

    @applejuice 没那么久的,我双机跑 deepseek v4 falsh 原版,首 token 在 2-8秒,单流50-80tps,6并发可以150-200tps

    LLM讨论区 dgxspark qwen-27b gb10

  • 关于显卡的购买。
    Rex FanR Rex Fan

    @benton-yi
    梁总的录音了说,即使DS这个api定价,一张卡的回本周期也就10个月。现在除了AI,还有哪个行业可以在万亿规模中做到10个月回本的?我认为即使有泡沫,也不是很大,更多是市场并没有反应过来科技公司的夸张需求可能真的是真实的

    随便聊聊
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组