請問有使用minimax H3 r2v 的大大門,有沒有覺得影片總是被ref image 改帶篇了?
-

給附圖,其實這問題困擾我很久了。每次用 r2v model 很常常首幀直接拿 ref image,或甚至直接搬移影片(ref video)。用起來常常變成 fl2v 一樣了,要常常抽卡,有機會 ref 的素材才真的變成「參考素材」。
目前用的是 MiniMax H3 Ref2V(minimax_h3_ref2va_pruned_int8_convrot),搭配 Qwen3-VL 32B text encoder、FL2V Turbo 8-step LoRA(1.0)。附圖這次是丟 1張 ref image。
目前在等有更好的 IR-context node 之類的……
不知道有沒有人找到比較穩定的方法,可以讓 image/video reference 真的只提供 identity / appearance / motion reference,而不是直接主導 initial frame。 -
@Yell0wDevil 这个现象是 ref2v 模型"参考锚定"的设计使然,不是 bug,但参数可以往"参考"而不是"复制"那边掰:
-
首帧直接拿 ref image:ref2v 的工作方式就是把参考图当首帧条件锚定,强度拉满时后续帧也会被持续拽向参考图,看起来就变成 fl2v。ComfyUI 节点里找 ref 强度/参考权重这类参数(不同封装叫法不一,常见 ref strength / ref image strength),从默认值往下调,先试 0.5~0.7 区间,越低越自由、越高越贴参考。同时把 cfg 压到 2~3,高 cfg 会强化"贴参考"。
-
传了 ref video 会更夸张:模型会倾向直接搬移参考视频的动作和构图。如果目标只是"参考人物 + 全新动作",只传 ref image、别传 ref video;要参考动作才传 video,并且同样把 ref 强度调低,否则就是换皮复刻原视频。
-
步数/采样器/seed:这类模型对这三个都敏感。步数提到 30~40,换 DPM++ 2M 或 Euler 试,多抽几个 seed。"要常常抽卡"本身就说明 ref 强度偏高,参数调对后成功率会明显上来。
-
确认加载的是配套的 ref2v checkpoint:minimax_h3_ref2va_pruned_int8_convrot 这个文件名是对的(带 ref2v),如果用普通 H3 底模 + ref 条件,就会表现成你说的乱锚定。Qwen3-VL 当文本编码器没问题。
一句话:先降 ref 强度到 0.5~0.7 + cfg 2~3 + 步数 30+,并且只传图不传视频参考,抽卡成功率会明显改善。如果完全不想要"首帧=参考图"这个行为,那应该用普通文生视频模型 + 首帧图条件,而不是 ref2v。
-
-
謝謝! 我試試看
-
謝謝! 我試試看
@Yell0wDevil 他是AI,你呼叫 @imbiplaza-asus @kop-wang 来解答。
-

給附圖,其實這問題困擾我很久了。每次用 r2v model 很常常首幀直接拿 ref image,或甚至直接搬移影片(ref video)。用起來常常變成 fl2v 一樣了,要常常抽卡,有機會 ref 的素材才真的變成「參考素材」。
目前用的是 MiniMax H3 Ref2V(minimax_h3_ref2va_pruned_int8_convrot),搭配 Qwen3-VL 32B text encoder、FL2V Turbo 8-step LoRA(1.0)。附圖這次是丟 1張 ref image。
目前在等有更好的 IR-context node 之類的……
不知道有沒有人找到比較穩定的方法,可以讓 image/video reference 真的只提供 identity / appearance / motion reference,而不是直接主導 initial frame。我为了克服,写了一整套adobe premier studio
https://lcz.me/topic/1317/minimax-h3-director-cut-studio-教程-教程更新在第5楼
-
我找到問題了,官方的prompt guide有說該怎麼用。我是智障。。。
在summary section 裡第一行加[reference generation]就行了