AI 課本 › 🎛️ ComfyUI 工作流

我們打造了免費的 AI 渲染引擎,用於 CG 與臉部動畫(ComfyUI + Blender)(第 1/2 段)

2026/06/19 · 22 分鐘 · 字幕實證
用 Blender 的 control passes 搭配 LTX 2.3,在本機做 AI 渲染並加上 lip-sync
💡 你可以怎麼用:如果你手上有 Blender 場景,可以先照片中做法輸出一段 depth pass 和 outline pass,再挑一格畫面用 Flux 生出參考圖定畫風,拿同一組素材換不同 prompt 比較效果。想做角色說話,記得準備一張 mask,只把嘴或臉塗黑,讓 AI 在那一塊自由發揮。
看全部 68 條重點

🧑‍🏫 這支影片示範怎麼用 Blender 輸出的 3D 參考畫面搭配 LTX 2.3 影片模型,在自己電腦上把粗糙的 3D 動畫算成有畫風、有光影的影片,還能讓角色對嘴說話。值得看的原因是整套工具免費,而且構圖和動作由你在 3D 裡決定,AI 只負責補外觀和細節,不是打一句話就只能接受 AI 生出來的結果。

📘 術語
lip-sync(對嘴):給音檔並標出允許 AI 接手的區域,讓角色嘴型配合聲音
render passes / control passes(渲染通道/控制通道):從 3D 程式直接取出、用來驅動 AI 動畫的影片,例如 depth pass、outline pass
depth pass(深度通道):黑白影片,白色像素離鏡頭近,黑色像素離鏡頭遠;讓模型理解 3D 幾何
outline pass(輪廓通道):告訴 AI 幾何邊緣在哪裡,讓它填滿邊緣之間的內容
depth map(深度圖):場景佈局轉成的深度圖,用來引導 Flux,固定構圖與鏡頭
mask(遮罩):黑白圖:白色要求精確跟隨 control guides,黑色讓模型自由生成新細節
Wan(Wan 影片模型):作者上一支影片用的影片模型,效果酷但吃資源又慢
LTX 2.3(LTX 2.3 影片模型):速度快的影片模型,也能同時生成音訊與影片,或配合注入的音訊生成影片
Flux(Flux 圖像模型):圖像模型,在 Blender 內被接成 render engine,由 depth map 引導
keyframe generator(關鍵影格生成器):在 Blender 內依 3D 幾何用 AI 渲染起始與結束影格
viewport(視圖區):在這裡粗排場景,連灰盒也行
upscale(放大解析度):ComfyUI template 最後把影片放大到 4K
ComfyUI(ComfyUI):免費、node-based 的 AI 模型介面
custom node(自訂節點):工作流需要的額外節點,缺少時從 manager 安裝
Llama 3.1(Llama 3.1 語言模型):依場景描述發想出一串可能屬於該場景的物件
Sana(Sana 模型):NVIDIA 的模型,為每個物件生成快速預覽
Trellis(Trellis):Microsoft 的工具,把預覽圖轉成含幾何、材質的 3D 模型;角色則用 Trellis for ComfyUI
prop house(道具行):作者比喻:像走進道具行挑喜歡的物件來佈置場景
Decimate modifier(減面修改器):rig 前用來降低模型的 vertex 數
merge by distance(依距離合併):在 Edit Mode 全選後使用,讓 mesh 更輕、更乾淨
rig / Rigify(骨架綁定/Rigify):Blender 內建 addon,放幾根骨頭就自動建出比例正確的完整 rig
weight painting(權重繪製):作者手動用它修補 rig 壞掉的部位
Workbench(Workbench 渲染引擎):懶人做 outline 的方式:切到 Workbench,開 outline 與 cavity 後渲染
Freestyle(Freestyle):Blender 裡可做 outline 的工具,上一支影片用過
Invert Color node(反轉顏色節點):depth 數值是反轉的,所以先加這個節點
Normalize node(正規化節點):把所有數值壓到 0 到 1 之間,變成白近黑遠
RGB Curve node(RGB 曲線節點):可用來把前景分離得更明顯
Viewer node / File Output node(檢視節點/檔案輸出節點):Viewer node 用來查看 depth 輸出;File Output node 可存出所有圖片
concept art / storyboard(概念圖/分鏡):作者先手繪概念圖做設計,再用手繪分鏡規劃整部片
✏️ 小考一題

作者用黑白 mask 解決「音訊和 control passes 互相衝突」的問題。mask 裡的黑色區域代表什麼?

A. 模型必須精確跟隨 control guidesB. 模型可以在這裡自由生成新細節C. 這裡的背景會被移除D. 這裡的音訊會被靜音
看答案
答案:B。[03:47] 字幕說 mask 的白色區域讓模型精確跟隨 control guides,黑色區域讓模型自由生成新細節,所以黑色區域蓋住嘴巴就能加 lip-sync。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。