MiniMax H3 本地视频生成经验分享(AMD RX7900XTX)
经过被老特训了一轮后,我也就继续我的旅途,但开始继续前,我就来尝试一下minimax H3。先大概介绍一下我的环境吧
一、服务器配置
| 项目 | 配置 |
|---|---|
| CPU | AMD 线程撕裂者 3960X(24核) |
| 内存 | 128GB(8*16GB)DDR4 |
| GPU | 华硕 TUF AMD Radeon RX 7900 XTX 24GB |
| 存储 | 21TB SSD,1500GB SSD,8*8TB 机械硬碟 |
| 主板 | 技嘉 Aorus TRX40 |
| 电源 | 全汉 1000W |
二、服务器环境
因为需要跑各种服务,所以我的是装了Proxmox虚拟机,也只能先给一半的配置给comfyui。
| 项目 | 配置 |
|---|---|
| 虚拟化 | KVM 虚拟机(GPU 直通) |
| CPU | 24 vCPU(可以理解成12核) |
| 内存 | 64 GiB |
| GPU | AMD Radeon RX 7900 XTX 24GB(GPU 直通) |
| 存储 | 120GB,240GB SSD |
| 系统 | Ubuntu 24.04.4 LTS,kernel 6.8.0-137-generic |
三、软件栈与版本
至于装什么包,我是没什么去注意的,我的都是直接用最新版本的,AI推荐的。
| 组件 | 版本 |
|---|---|
| ComfyUI | 0.33.0 |
| Python | 3.12.3(独立 venv) |
| PyTorch | 2.13.0 + rocm7.2.4 |
| 其他 | diffusers 0.39.0、transformers 5.14.1、av 18.0.0、scenedetect 0.7.1 |
四、模型与节点
我个人比较喜欢导演台的工作流,找到一个不错的就直接抄过来,然后在改一点(从sage attention改去comfy kitchen attention, 如果要让amd显卡跑sage attention,我是不想折腾)
- 扩散模型:minimax_h3_fl2va_pruned_int8_convrot.safetensors,也有下载 ref2va版本,不过我的需求暂时没有用到,所以没有测试
- 文本编码:Qwen3-VL-32B nvfp4_awq
- VAE编码:video VAE fp16(4.9GB)+ audio VAE fp32(0.6GB,32kHz 立体声,本项目静音使用)
- LoRA模型:lightx2v的fl2v turbo 8step v1.0(不过AI用了Kijai大神的重打包版 347MB,因为官方的有问题),当然也有下载 ref2v的官方版本(ref2v turbo 4step v0.1),不过我目前也是没测试过
- 节点:AIMixer的导演台,Spectrum加速,comfy kitchen attention
五、工作流设置
我需求是文生视频,720P,4:3,不需要音频,每段约7秒
- 采样:8 步 / res_multistep / simple / CFG=1.0 / sigma shift video 12 · audio 3(因为有8步turbo lora,所以采样也是8步)
- 输出:1024×768(0.75 megapixels),24fps · 175帧(7.3s)(turbo lora用768P训练,所以调去0.75去对应他的解析度)
- audioMode=mute
- 开 lowvram 模式
- 启动参数 --disable-pinned-memory,不然会崩溃
六、MiniMax H3 vs LTX-2.3 实测对比
- 速度:生成一个7秒钟 720P的视频,都很稳定在445秒(7分钟25秒)左右,跟LTX2.3(2分钟30秒)对比,的确慢了许多,但这样的配置能达到7分钟半已经算可以了
- 画面合理性:MiniMax H3肯定是比较好的那个,简单测了两个在LTX2.3不行的场景(拿起铅笔书写的场景和把纸揉成团丢掉的场景),MiniMax H3目前都表现的不错,手部动作流畅合理,纸张的变动自然。我只能说LTX2.3对动作类的场景表现一直以来都较弱。
- 画质与细节:我没那么注重,这方面我不做评价。画面能用,对我来说就足够了
七、心得
要我做个选择,我是会多花3倍的时间换一个可用的画面,因为LTX2.3的画面不稳定,需要大量抽卡,即使生成时间短,需要生成很多视频才能抽到一个可用的,那还大不如用更稳定的minimax H3,反正到头来生成时间都差不多,我也能节省了来来回回和赛选的时间。我也只是做个简单的测试,如果有高手觉得有问题,欢迎指点。
连接与参考
我分享一下工作流,AMD用户可以尝试看看,但不保证能直接用,如果遇到什么问题就直接丢给hermes加v4 flash,他会帮你搞定的。
工作流:MiniMax H3 Director.json
导演台节点链接:https://github.com/AIMixer/ComfyUI_MiniMaxH3_Director
spectrum加速节点链接:https://github.com/xmarre/ComfyUI-Spectrum-MiniMax-H3

LTX-2.3 设置
- 扩散模型:
ltx-2.3-22b-distilled-Q4_K_M.gguf(14GB,GGUF 量化) - 文本编码:gemma_3_12B_it_fp4_mixed(8.8GB)+ text_projection_bf16(2.2GB)
- VAE:LTX23 video/audio VAE(bf16)+ taeltx2_3
- 采样:主渲染 8 步 / CFG=1.0 / euler / linear_quadratic(官方蒸馏规范),精修渲染 4 步 denoise 0.42 + 放大一倍(spatial x2 upscaler)