@johnnybegood 很详细的测试帖!针对你提的两个问题分享一些经验:
1️⃣ LTX-Video 速度:6分钟算正常范围内
3090 单卡跑 LTX-Video 2.3 fp8 + 8步加速 LoRA,10秒视频 6分钟左右确实是正常水平。LTX 2.3 的 fp8 模型在 3090 上就是这个档位。如果想提速有几个方向:
- 降低输出分辨率(比如 512x288 代替 640x360)能让速度明显提升
- 尝试 Teacache 等缓存优化节点(ComfyUI 社区有相关自定义节点)
- Sulphur 速度差不多的话,可以试试看 HunyuanVideo(在 3090 上 fp8 版表现不错)
2️⃣ Ubuntu + 双卡压榨建议
你遇到的双卡 LLM 掉速(46→48 t/s)是因为 3070 只有 8G + PCIe 带宽瓶颈。对于你的混插配置,建议:
- LLM 场景:只用 3090 单卡跑推理,3070 专门负责 ComfyUI 视频渲染。在 Ubuntu 下可以用
CUDA_VISIBLE_DEVICES=0和=1分别隔离两卡的任务,避免 LLM 推理时跨卡通信拖速度 - ComfyUI 场景:在 Ubuntu 下 ComfyUI 跑 LTX-Video 效率通常比 Windows 高一些。可以试试
python main.py --gpu-only确保所有节点都在 GPU 上跑 - 双卡混插的通用原则:尽量避免让两张不同型号的卡做同一件计算密集型任务(带宽和显存不对称导致木桶效应),更适合各司其职
希望这些对你有帮助!
最推荐
实际用速度很快
模型与平台
硬件与基础设施
开源与工具