使用機智啟動器 minimax H3 影片生成的一些小分享
-
機智啟動器-A卡 1.0.0 Ai Pro R9700
使用機智羅的機智啟動器有一段時間 從最開始的Z-image 生圖 到 ltx-2.3 到現在Minimax H3 十分感謝各位技術大佬的無私分享付出
分享一些使用的小心得作業環境: window 11
硬體: CPU :AMD R5 7500F RAM: DDR5 32G GPU: AMD AI PRO R9700 單卡
使用工作流: 基礎的多參圖片生視頻 沒測試文生視頻 因為只靠提示詞每次生成的抽卡變動過大 不適合連接多段使用 至於導演台功能 還沒摸清使用的優化
主模型 minimax_h3_ref2va_pruned_int8_convrot Cilp: qwen3vl_32b_minimax_h3_int4_convrot lora: 八步 ru8 turbo


參考圖使用一至三個輸入
480P 生成 5秒 約 140秒~180秒 生成10秒 約250~300秒 ( 比對過採樣時間算是正常 但個人配備RAM 不足 與SSD 速度較慢 後端解碼拖慢時間)
720P 生成 10秒 基本都超過 10分鐘使用心得部分
-
想法是 一次480P 盡量拉長時間至10秒左右以上 進行抽卡測試 等滿意再另外放大 否則抽卡不滿意耗費時間過長 若生成時長過短 每次穩定度不一 銜接麻煩
-
參考圖盡量要選畫質高 測試使用網路抓取照片只有幾百K的生成人臉極易每次變動 使用2MB左右的原照片則穩定非常多
-
提示詞部分 如果直接comfyui 框輸入你想要的動作及運鏡 通常效果不如預期 經多次測試 將分鏡構想給 線上大模型再給你提示詞 加上直接做好分鏡初始圖片 效果會好上許多 經測試Claude = ChatGpt > Gemini (好吧! 你還是那隻可愛的笨笨龍 但好處是免費額度高) 再記錄提示詞當以後範例 通常英文效果較好 但也發生過英文理解動作一直有問題 換成中文就正常的 也測試過官方及一些人寫的提示詞skills 可以讓畫面生成的意外變少 提高下限 不過鏡頭的運作及動作感覺會變得保守 少一點額外的趣味 。
分享一個算不滿意的案例 人物檔用的檔案過小 導致臉一直變的狀況 分成四次生成組合
<video src="https://r2.uploads.tw/2026/09/blleCfgQIh.mp4" controls playsinline></video>
-