AI 課本 › 🎛️ ComfyUI 工作流

ComfyUI 中的 MiniMax H3:最強 AI 影片?免費 StoryBoard 工作流

2026/08/08 · 14 分鐘 · 字幕實證
介紹 ComfyUI 內建的三個 MiniMax H3 工作流,以及作者自製的首尾幀分鏡工作流
💡 你可以怎麼用:先用範本裡的 Image-to-Video 跑一次:用別的生圖工具做一張高品質首圖,請 LLM 照範例 prompt 的格式寫描述,時長設 5~10 秒。熟悉之後再下載作者的分鏡流程,建議分段輸出,最後再把各段剪在一起。
看全部 50 條重點

🧑‍🏫 這支影片介紹 ComfyUI 內建的三種 MiniMax H3 影片工作流:圖生影片、文字生影片、參考生影片,並分享作者自製的免費分鏡工作流。分鏡工作流可以把多張圖一段段接成長影片。影片也直接展示了跳格、音樂關不掉等實際問題,讓你知道現階段做得到什麼、要注意什麼。

📘 術語
first last frame(首尾幀):一張圖當開始幀、下一張當結束幀,模型生成兩者之間的影片
storyboard(分鏡):做好多張圖並描述各段之間的內容,串成長度不限的無縫影片
template(範本):在 ComfyUI 的 template 中選 video 可找到 MiniMax H3 工作流
Image-to-Video(圖生影片):上傳圖片、描述鏡頭與動畫來生成影片,是最常用的一種
Text-to-Video(文生影片):只寫描述就能執行,但作者覺得細節較少
Reference-to-Video(參考生影片):用多張圖當參考圖,也能輸入參考影片與音訊
aspect ratio(長寬比):直式橫式圖都能上傳,但仍需在下方指定
megapixels / multiplier(百萬像素/倍率):megapixels 是檔案要多大,另有其倍率;可能讓人混亂,維持預設即可
LLM (large language model)(大型語言模型):作者拿它把範例 prompt 當格式,整理自己的描述
clip model(CLIP 模型):本工作流用 Qwen2.5-3,屬 visual language 模型,能吃長 prompt
duration(時長):預設 5 秒,作者常用 10 秒
VRAM(顯示記憶體):預載的模型都會佔用它,越多跑越快
combine node(合併節點):最後的 save 是 combine node,打開可見 diffusion model 處理流程
panel(分鏡格):每格含圖片與 story panel 描述;下一格的圖是前一格的最後一幀
storyboard manager(分鏡管理器):接收所有 panel,統一設定長寬比、模型與 steps
UNet / VAE(UNet/VAE):字幕未解釋,僅提到 storyboard manager 要連接這些模型
steps(步數):字幕未解釋,僅提到在 storyboard manager 設定
segment(片段):分段輸出,各段無縫,之後再組合;作者認為效果較好
transition(轉場):可直接在文字裡描述 panel 之間要怎麼轉場
✏️ 小考一題

MiniMax H3 Image-to-Video 工作流的 duration 預設是多少秒?

A. 10 秒B. 3 秒C. 60 秒D. 5 秒
看答案
答案:D。[03:47] 字幕說 duration 預設為 5 秒;10 秒是作者自己在 RTX 3090 上的設定
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。