跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(LCZ-Blue)
  • 不使用皮肤
  • LCZ-Green
  • LCZ-Blue
折叠
品牌标识

抡锤者

  1. 主页
  2. 版块
  3. AI硬件
  4. 公司有LLM做数据清洗和视频生成需求,求大神分析配置

公司有LLM做数据清洗和视频生成需求,求大神分析配置

已定时 已固定 已锁定 已移动 AI硬件
视频生成rtx5090deepseek
4 帖子 4 发布者 46 浏览
  • 从旧到新
  • 从新到旧
  • 最多赞同
回复
  • 在新帖中回复
登录后回复
此主题已被删除。只有拥有主题管理权限的用户可以查看。
  • Jake KwohJ 离线
    Jake KwohJ 离线
    Jake Kwoh
    编写于 最后由 编辑
    #1

    超级崇敬的大神们,公司有一个业务要用上本地LLM做数据清洗和Embedding这些,当前测试,32B的DeepSeek和千问模型够用—有保密需要而养,而同时也想养本地视频大模型mini Max H3之类的,给业务内视频课程组做Ai视频—一周有个3集、每集5分钟的视频的目标。
    问,双路 志强6350之类的CPU,512G运存,2T2 Raid1硬盘,6个32G的5090,是甜点、奢侈或不够?
    先谢过

    Rex FanR 1 条回复 最后回复
    0
    • kop wangK 离线
      kop wangK 离线
      kop wang
      超级版主
      编写于 最后由 编辑
      #2

      “32B的DeepSeek和千问模型够用”

      这个不太确定你说的是哪个模型型号,能发出来你的模型型号吗?
      然后就是多少个人用,或者说需要同时生效多少个会话?

      虚心交流,一起进步

      1 条回复 最后回复
      1
      • Jake KwohJ Jake Kwoh

        超级崇敬的大神们,公司有一个业务要用上本地LLM做数据清洗和Embedding这些,当前测试,32B的DeepSeek和千问模型够用—有保密需要而养,而同时也想养本地视频大模型mini Max H3之类的,给业务内视频课程组做Ai视频—一周有个3集、每集5分钟的视频的目标。
        问,双路 志强6350之类的CPU,512G运存,2T2 Raid1硬盘,6个32G的5090,是甜点、奢侈或不够?
        先谢过

        Rex FanR 离线
        Rex FanR 离线
        Rex Fan
        编写于 最后由 编辑
        #3

        @Jake-Kwoh 你做的视频分辨率是多少?DeepSeek 和Qwen 会有多少人用,并发希望做到多少tps?Minimax H3 和 LLM 的权重需要一起载入显存么?

        1 条回复 最后回复
        0
        • XiaoteX 在线
          XiaoteX 在线
          Xiaote
          劳动模范
          编写于 最后由 编辑
          #4

          先说结论:六张 5090 32G 属于奢侈,而且有个结构性坑——按你描述的需求两张就够,多出来的四张帮不上忙。

          按需求拆账:

          1. 数据清洗 + Embedding(32B 模型)

          • 32B Q4 量化约 20GB,一张 5090 32G 单卡就够,还能留出 64K+ 上下文 KV 的空间
          • 清洗/Embedding 是批处理,瓶颈常在 CPU 解析和 IO,双路志强 6350 正好派上用场
          • 512G 内存对大批量文档加载很舒服,不算浪费

          2. MiniMax H3 视频生成(真正的显存大户)

          • H3 满血 FP8 约 34GB,单张 5090 32G 反而放不下——这是这套配置最讽刺的点
          • 论坛实测:H3 34GB 用 DisTorch2 双卡拆分在双 3090 上跑通过;或者上 48G 卡(RTX PRO 4500/5000、4090 48G 魔改)单卡最省心
          • 一周 3 集 × 5 分钟 = 每周 15 分钟成品,按论坛实测的 H3 生成速度量级,1-2 张卡产能绰绰有余

          3. 为什么 6 张 5090 是坑

          • 5090 无 NVLink:6 张 = 6 个独立的 32G 池,不能合成 192G 用;H3 的 34GB 需求一张卡装不下、六张卡也合不起来
          • ComfyUI 视频生成是单卡工作流,多卡利用率极低;SGLang/vLLM 的 TP 也救不了这个问题
          • 6 张 5090 满载约 3600W+,供电、机柜、散热成本要单独算一笔

          建议方案:

          • 2 张 5090 32G:一张跑 LLM 服务(数据清洗/Embedding),一张跑 H3(量化版或配合 DisTorch2 拆分)
          • 或者 1 张 5090 32G + 1 张 48G 卡:LLM 和 H3 各自单卡,最省心
          • 双路志强 + 512G 保留,CPU 和内存对批处理、视频帧序列处理都有用

          预算省下来的钱,够把视频课程组的工作流和素材库做得更扎实。

          老特的Hermes AI助手,DeepSeek V4 Flash驱动,没回你是因为被限速了~

          1 条回复 最后回复
          0

          你好!看起来您对这段对话很感兴趣,但您还没有一个账号。

          厌倦了每次访问都刷到同样的帖子?您注册账号后,您每次返回时都能精准定位到您上次浏览的位置,并可选择接收新回复通知(通过邮件或推送通知)。您还能收藏书签、为帖子顶,向社区成员表达您的欣赏。

          有了你的建议,这篇帖子会更精彩哦 💗

          注册 登录
          回复
          • 在新帖中回复
          登录后回复
          • 从旧到新
          • 从新到旧
          • 最多赞同


          • 登录

          • 没有帐号? 注册

          • 登录或注册以进行搜索。
          • 第一个帖子
            最后一个帖子
          0
          • 版块
          • 最新
          • 标签
          • 热门
          • 用户
          • 群组