ComfyUI MiniMax H3 加速 LoRA + VRAM 監控節點(第 32 集)


🏦 台灣Pay 銀行轉帳 💙 PayPal
用 LoRA 加速 ComfyUI 的 MiniMax H3 影片生成,並用節點監看與清除 VRAM
- 00:00 MiniMax H3 很強,但生成影片可能很慢。本集示範用 LoRA 加速,同時監看 VRAM。
- 07:15 free VRAM 節點的輸入值和輸出值相同,所以可放在其他節點之間而不中斷連線。它不改變數值,只清 VRAM。
- 14:23 最高等級是 Legends,對頻道幫助最大、福利也較多。YouTube 現在也提供免費試用。
💡 你可以怎麼用:想快速出片就用 LoRA、shift 設 6、8 步,longest side 先從小尺寸試起,prompt 交給免費的 Gemini gem 寫;用現成音軌讓角色唱歌或說話時,改跑 4 步就好。跑完記得看 monitor 節點的 VRAM 峰值,再決定尺寸能不能往上加。
看全部 85 條重點
🧑🏫 這支是 ComfyUI 系列第 32 集,教你用 LoRA 讓 MiniMax H3 生影片快好幾倍,並用監看節點隨時掌握顯卡記憶體。作者附了實測過的參數,還示範了文字生影片、首格生影片、首尾格、唱歌、說話幾種 workflow,照著用就能少走很多冤枉路。
- 00:00 MiniMax H3 很強,但生成影片可能很慢。本集示範用 LoRA 加速,同時監看 VRAM。↳ MiniMax H3 是能生成影片的 AI 模型,效果好但很慢。本集做兩件事:用 LoRA(掛在主模型上的小型附加檔)加速,並隨時看 VRAM(顯示卡記憶體)夠不夠用。
- 00:00 先做更新。有 Easy Installer 的人可從 launcher 更新,沒有的人用 bat 檔更新。↳ 開工前先更新。裝過作者 Easy Installer(一鍵安裝包)的人,在啟動器(launcher)按更新就好;沒裝的人就點 bat 檔(Windows 雙擊就會執行的腳本)更新。
- 00:00 更新 Easy Install 會順便更新 PiXarooma nodes,也可以用 git pull 手動更新。↳ 更新 Easy Install 時,作者做的 PiXarooma nodes(擴充節點包)會一起更新。也可以自己下 git pull,這是從網路抓最新版程式碼的指令。
- 00:00 接著更新 ComfyUI,因為近期的更新修正了一些 bug。↳ ComfyUI(用拉節點、連線來跑 AI 生圖生影片的工具)本身也要更新,因為最近幾版修了一些錯誤。
- 00:30 ComfyUI 可用瀏覽器版或桌面版啟動。作者建議用 Kitchen Attention 啟動,因為它已整合進 ComfyUI;Sage Attention 速度差不多。↳ ComfyUI 可以開在瀏覽器,也可以用桌面版。作者建議用 Kitchen Attention 啟動,它是加快模型運算的方式,已內建在 ComfyUI;Sage Attention 是類似的加速方式,速度差不多。
- 00:30 兩種做法二選一:用啟動參數啟用,或在 workflow 加 Sage/Kitchen Attention 節點並正常啟動。用參數啟動時,workflow 裡就不要再加這些節點。↳ 加速有兩種開法,二選一:啟動時加參數,或在 workflow(節點連成的一整套流程)裡放加速節點並正常啟動。用了參數,就別再加節點。
- 00:30 可加 Version Check 節點,確認 ComfyUI 與 PiXarooma nodes 版本和作者相同或更新。版本較舊時,部分功能可能不正常。↳ Version Check 節點會檢查你的 ComfyUI 和 PiXarooma nodes 版本,要跟作者一樣或更新。版本舊了,有些功能可能跑不正常,出問題時先查這裡。
- 01:01 免費 workflows 放進 workflows 資料夾後,可從 PiXarooma nodes 的選單開啟,也可從左側一般的 workflows 選單開啟。↳ 作者的免費 workflow 檔丟進 workflows 資料夾後,可以從 PiXarooma nodes 的選單打開,也可以從 ComfyUI 左邊的 workflows 清單打開。
- 01:01 本集的 MiniMax workflows 看懂做法後,可以改寫成更多 H3 workflows。↳ 本集的幾個 MiniMax workflow 可以當範本。看懂做法後,可以自己改出更多 H3 的用法。
- 01:01 安裝細節在 episode 29。節點裡列出所有需要下載的模型和擺放位置。↳ 第一次安裝的步驟在第 29 集。workflow 裡有節點列出要下載哪些模型、各放哪個資料夾,照著做就行。
- 01:01 和 episode 29 不同的是新增一個 LoRA,可把步數從 20 降到只要 4 或 8,藉此加快生成。↳ 跟第 29 集的差別是多了一個 LoRA。steps(步數)是 AI 反覆修飾畫面的次數,原本要 20 步,加了 LoRA 只要 4 或 8 步,所以快很多。
- 01:35 LoRA 下載後放在 LoRAs 資料夾內的 H3 資料夾。↳ LoRA 下載後,要放在 LoRAs 資料夾底下的 H3 資料夾,workflow 才讀得到。
- 01:35 在 workflow 中,把 LoRA Loader 加在 diffusion model 載入之後、KSampler 之前。↳ LoRA Loader 是讀取 LoRA 的節點。順序是:先載入 diffusion model(負責生成的主模型),接著接 LoRA Loader,再接 KSampler(實際跑步數、產生結果的節點)。
- 01:35 Claude 發現這個 LoRA 是用 shift 6 訓練的,所以不用 ComfyUI 預設的 12,改用 6。↳ Shift 是影響生成過程的一個參數。Claude(AI 助手)查到這個 LoRA 訓練時用的是 6,所以照訓練條件設成 6,不用 ComfyUI 預設的 12。
- 02:07 作者試過不同 shift 值,這組設定效果良好。↳ 作者實際試過不同的 shift 值,比較後這組效果好,可以直接照用。
- 01:35 作者改過節點名稱。想查原始名稱,可複製節點、按右鍵選 Fix Node Recreate,就能看到預設外觀、數值和原始標題。↳ 作者把節點改過名字。想看原名,就複製一個節點,按右鍵選 Fix Node Recreate,它會重建成預設樣子,顯示原始標題和預設數值。
- 02:07 選擇影片尺寸時先從小開始,測試顯卡能負荷多大;橫向、直向都可以試。作者常用的尺寸旁有星號標記。↳ 影片尺寸先從小的試,看你的顯卡撐得到多大,橫的直的都能試。清單裡標星號的是作者常用的尺寸。
- 02:07 時長以秒為單位,最多 15 秒。↳ 影片長度直接填秒數,最長 15 秒。
- 02:07 prompt 要寫得詳細,而且需要用特定方式撰寫。↳ prompt(給 AI 的文字描述)要寫得很詳細,而且要照這個模型適合的寫法寫,不能隨便丟一句話。
- 02:07 作者把測過的 sampler、scheduler、steps 最佳設定都放進一個節點。對他來說最佳組合是 Euler + simple、8 steps。↳ sampler 和 scheduler 決定每一步怎麼計算、步驟怎麼分配。作者把測過的最佳設定放進一個節點,他的首選是 Euler+simple 跑 8 步。
- 02:07 4 steps 更快,但音訊只有 4 步不夠時間變好聽,許多 seed 下音質較差。不在意音質的話可以用 4 steps。↳ 這模型會連聲音一起生成。4 步雖然快,但聲音來不及修好,很多 seed(決定隨機結果的起始號碼)下都偏難聽。不在乎聲音就可以用。
- 02:41 8 steps 的音訊好很多。要最佳品質,就不用 LoRA、改跑 20 steps。↳ 8 步的聲音好很多。要最好的品質,就把 LoRA 拿掉,跑完整 20 步。
- 02:41 這個節點是 dropdown PiXarooma node,本週有更新:在 settings 中最多可設四個輸出,值可以是文字或數字。↳ 這個節點是 dropdown PiXarooma node,也就是下拉選單節點。本週更新後,settings 裡最多能設四個輸出,文字或數字都行。
- 02:41 下拉選單的每個選項都能各自設定這些輸出值。作者放的是 samplers、schedulers、steps。↳ 選單裡每個選項都能有自己的一組輸出值。作者放的是 sampler、scheduler、steps,選一個選項就一次切換三項設定。
- 02:41 也可以放 models、sizes、prompts 等各種東西。詳情看節點的 help 區。↳ 這個選單不限用途,也能放模型、尺寸、prompt 等。設定方式寫在節點的 help 說明區。
- 03:13 作者在下拉選單加了 5 個選項,每個選項有 3 個輸出值。按加號新增選項,按 X 移除。↳ 作者的選單有 5 個選項,每個選項帶 3 個值。按加號新增選項,按 X 刪除。
- 03:13 monitor 節點會顯示 VRAM、RAM、溫度等資訊。在 settings 裡可決定要顯示或隱藏哪些值。↳ monitor 節點是監看面板,會顯示 VRAM、RAM(電腦主記憶體)、溫度等。在 settings 裡可以決定哪些要顯示、哪些要隱藏。
- 03:44 monitor 做成節點,所以可以隨意移動或移除。↳ 它做成節點而不是固定介面,所以想放哪就拖到哪,不要也能直接刪掉。
- 03:44 另有更極簡的 strip 版面,可在 settings 調整顯示內容,並手動縮放到想要的大小。也能控制節點上出現哪些按鈕。↳ 另外還有更精簡的 strip 版,是一條細長的顯示列。在 settings 可以選要顯示哪些數字、節點上出現哪些按鈕,大小也能自己拉。
- 03:44 還有另一個 VRAM 節點,接在你想清除 VRAM 的節點之後。↳ 另一個 VRAM 節點是 free VRAM,接在哪個節點後面,那一步跑完就清掉 VRAM。
- 04:14 例如先用別的模型產生 prompt,之後清掉記憶體,才有足夠空間載入影片生成的 workflow。↳ 舉例來說,先用另一個模型寫 prompt,寫完就清記憶體,空出位置,後面的影片模型才載得進來。
- 05:00 作者把它放在 workflow 最後、VAE decode 之後。原因是近期 ComfyUI 更新後快取會一直累積到記憶體不足,這樣可以避免。↳ 作者把它放在流程最後,接在 VAE decode(把 AI 內部運算結果轉成真正畫面)之後。因為最近版本的快取會一直累積到記憶體不足,這樣可以避免。
- 05:00 缺點是:如果 VRAM 本來就夠,模型需要重新載入記憶體,會多花一點時間。↳ 代價是:如果你的 VRAM 本來就夠,清掉後模型得重新載入,會多花一點時間。
- 05:32 作者和 Claude 做了 54 次測試,比較不同 sampler 與 scheduler。text-to-video 以 Euler + Simple 分數最高,所以設為預設。↳ 作者和 Claude 做了 54 次測試,比較各種 sampler、scheduler 組合。text-to-video(純文字生影片)裡 Euler+Simple 分數最高,所以設為預設。
- 05:32 依風格和 prompt 不同,也可以試其他表現不錯的組合。有些組合結果非常差,應避免。↳ 不過畫風和 prompt 不同時,其他表現不錯的組合也值得試。有些組合結果非常差,要避開。
- 05:32 steps 也另外測過:8 steps 在品質與速度間最平衡。4 steps 較快,但可能搞砸音訊,所以推薦 8 steps。↳ 步數也另外測過:8 步在品質和速度間最平衡;4 步快,但可能把聲音弄壞,所以推薦 8 步。
- 06:06 12 steps 能再提升品質。真要最佳品質,就完全不用 LoRA、改用 20 steps。↳ 12 步品質還能再好一點。真的要最好,就完全不用 LoRA,改跑 20 步。
- 06:06 這幾個是資訊性質的節點,只留需要的就好,三個全刪也可以。workflow 可自由調整。↳ 這幾個是輔助看資訊的節點,只留需要的就好,三個全刪也可以。workflow 可以照自己的習慣改。
- 06:06 改用 Gemini 寫 prompt,因為效果好又快。它免費,任何 Google 帳號都能登入。↳ 寫 prompt 改用 Gemini(Google 的 AI 聊天工具),效果好又快,而且免費,有 Google 帳號就能登入。
- 06:06 告訴 Gemini 你要 text-to-video 的 prompt,給它時長,再描述想要的內容。↳ 跟 Gemini 說你要 text-to-video 的 prompt,告訴它影片幾秒,再描述你想看到的內容。
- 06:42 幾秒內就會得到一段長 prompt,用 replace 按鈕直接替換原本的 prompt。↳ 幾秒內它就會給出一段長 prompt,用 replace 按鈕直接蓋掉原本的 prompt。
- 06:42 時長設 5 秒以配合 prompt,這次改用橫向。↳ 時長設 5 秒,跟 prompt 寫的長度對上;這次畫面改用橫向。
- 06:42 執行時可在 Monitor PixAroma 節點看到 VRAM 用量等資訊。↳ 執行時可以看 Monitor PixAroma 節點,即時知道 VRAM 用了多少等資訊。
- 06:42 workflow 結尾放了 free VRAM 節點,所以執行完會清除 VRAM。不想要的話,刪除節點或按右鍵選 bypass。↳ 流程最後有 free VRAM 節點,所以跑完會清掉 VRAM。不想清的話可以刪掉它,或按右鍵選 bypass(暫時跳過不執行,但保留節點)。
- 07:15 free VRAM 節點的輸入值和輸出值相同,所以可放在其他節點之間而不中斷連線。它不改變數值,只清 VRAM。↳ free VRAM 節點收到什麼就原樣傳出去,所以插在兩個節點中間也不會斷線。它不改任何數值,只負責清記憶體。
- 07:15 這個 workflow 花了 55 秒。清除後 VRAM 只用約 2 GB。↳ 這次跑了 55 秒,清完後 VRAM 只佔約 2 GB。
- 07:46 結果符合要求而且相當快。但解析度越高,生成時間越長。↳ 結果符合要求,速度也快。但解析度設得越高,生成時間越長。
- 07:46 解析度對速度的影響最大;時長其次,但影響沒那麼大。↳ 影響速度最大的是解析度,其次是影片長度,但長度的影響比較小。
- 07:46 first frame to video workflow 加入了和前一個 workflow 相同的 LoRA 與 Shift。↳ first frame to video(給一張圖當第一格畫面,讓它動起來)的 workflow,也加了同一個 LoRA 和 shift 設定。
- 08:16 這個 workflow 需要保持第一幀一致,所以也另外測試。結果很接近,Euler + Beta 分數最高、設為預設,Euler + Simple 第二。↳ 這個流程要讓第一格跟原圖一致,所以另外測組合。結果很接近,Euler+Beta 最高、設為預設,Euler+Simple 第二。
- 08:16 因為有聲音,steps 一樣是 8 步效果較好。↳ 這個流程也會生成聲音,所以一樣用 8 步比較好。
- 08:16 用同一個 Google Gemini gem 生成 first frame to video 的 prompt,並描述想發生的事。↳ 用同一個 Gemini gem(在 Gemini 裡預先設好指示的專用小幫手)寫 first frame to video 的 prompt,描述你想讓畫面發生什麼事。
- 08:16 在 save MP4 節點中,於影片開頭加上 audio fade(音訊淡入)。↳ 在 save MP4(存成影片檔)節點裡,替影片開頭加上 audio fade,也就是讓聲音從小慢慢變大。
- 08:48 很多 MiniMax 影片一開頭聲音就很強,加 120 毫秒的淡入可以修正部分問題。↳ 很多 MiniMax 影片一開頭聲音就很衝,加 120 毫秒的淡入可以改善一部分。
- 08:48 生成 5 秒影片花了 48 秒。↳ 這支 5 秒影片花了 48 秒生成。
- 08:48 想測下拉選單裡沒有的設定,可刪掉它自行設值,例如 20 steps、不用 LoRA。↳ 想試下拉選單裡沒有的設定,可以把選單刪掉自己填值,例如不用 LoRA、跑 20 步。
- 08:48 first frame and last frame workflow 可以控制影片的結尾幀。↳ first frame and last frame 是同時給開頭和結尾的畫面,讓影片停在你指定的最後一格。
- 09:20 把兩張圖都給 Gemini,請它寫 5 秒的首尾幀 prompt。範例是一個旋轉動作,結尾時角色從紅洋裝換成牛仔褲。↳ 把兩張圖都丟給 Gemini,請它寫 5 秒的首尾格 prompt。範例是角色轉一圈,結尾從紅洋裝換成牛仔褲。
- 09:20 這個 workflow 的結果又不同,Euler + Simple 較好。可見 sampler 和 scheduler 對結果影響很大。耗時 55 秒。↳ 這個流程反而是 Euler+Simple 比較好,可見 sampler 和 scheduler 對結果影響很大。這次花了 55 秒。
- 10:00 影片解析度由 longest side 設定決定。設越高越久,VRAM 不夠時可能崩潰。↳ longest side 是影片最長那一邊的長度,用來決定解析度。設越高越慢,VRAM 不夠時可能直接崩潰。
- 10:00 作者顯卡上的 VRAM 峰值約 22 GB,峰值數值可以在節點上重設。↳ 作者顯卡的 VRAM 峰值約 22 GB。這個峰值紀錄可以在節點上重設,重新量。
- 10:00 如果接下來要用不同模型,有時可以開新 workflow 並先清除 VRAM。↳ 接下來要換別的模型時,有時可以開新的 workflow,先清一次 VRAM 再跑。
- 10:00 唱歌 workflow 讓角色用你上傳的音軌唱歌。目的是保留原本的音訊,而不是重新生成相似的聲音。↳ 唱歌 workflow 讓角色跟著你上傳的音軌唱。重點是保留你原本的聲音,而不是讓 AI 重新生成一段很像的。
- 10:31 先決定影片時長,上傳的音訊會依此裁切,作者的例子約 6 秒。接著上傳要唱歌的角色圖。↳ 先設影片長度,上傳的音訊會照這個長度裁切,作者的例子約 6 秒。接著上傳要唱歌的角色圖。
- 10:31 這些輸入素材都隨 workflows 一起附上。↳ 範例用的音訊和圖片都跟 workflow 一起附上,可以直接拿來練習。
- 10:31 作者經過大量測試,寫出一個多數情況都有效的通用 prompt,有助於保持圖像一致。↳ 作者測了很多次,寫出一段多數情況都有效的通用 prompt,幫忙讓角色維持原圖的樣子。
- 11:04 這不是 first-frame to video,而是 reference to video,用的是不同模型。prompt 提到的任何東西都可能改變角色。↳ 這裡用的是 reference to video(拿圖片當參考來生成),和 first frame 是不同模型。prompt 裡提到的任何東西,都可能讓角色變樣。
- 11:04 為了避免角色或服裝跑掉,盡量貼近原圖,所以用較長的 prompt。之後選好 longest side 就能執行。↳ 為了不讓角色或衣服跑掉,prompt 寫長一點、盡量貼近原圖。選好 longest side 就能執行。
- 11:04 這裡不生成音訊、用的是現成音軌,所以不需要為音質用 8 steps,改用快很多的 4 steps。↳ 這裡的聲音是現成音軌,不是 AI 生成,所以不用為了音質跑 8 步,改用快很多的 4 步。
- 11:36 也不加 audio fade,因為自訂音訊本身已經好聽。↳ 也不加淡入,因為你自己的音檔本來就好聽。
- 11:36 note 裡有更多說明,看完可以收合或刪除。↳ workflow 裡的 note(文字註解)有更多說明,看完可以收起來或刪掉。
- 11:36 測試發現,小尺寸下效果還可以,放大後就開始改變畫面內容。↳ 測試發現,小尺寸時效果還可以,尺寸一放大,畫面內容就開始被改動。
- 12:09 到某些尺寸時,模型會不那麼精確地遵循 prompt。小尺寸有效的做法,放大後不一定有效,至少作者用的 reference 模型是如此。↳ 尺寸大到某個程度,模型就比較不照 prompt 走。小尺寸有效的做法,放大後不一定有效,至少作者用的 reference 模型是這樣。
- 12:09 first-frame 模型比較遵守 prompt。reference 模型較有創意,能吃音訊和圖片等,但可能不夠精確。↳ first frame 模型比較聽 prompt 的話;reference 模型比較有創意,能同時吃聲音和圖片,但可能不夠精準。
- 12:39 說話 workflow 和唱歌的是同一個,只是長 prompt 改為說話用:不跳舞、鏡頭固定等。↳ 說話 workflow 跟唱歌的是同一套,只把長 prompt 換成說話版,例如不要跳舞、鏡頭固定。
- 12:39 prompt 提到的東西都可能被加進畫面,即使寫「不要加黑背景」也可能加上。要小心下 prompt,並嘗試不同 seed 與尺寸。↳ prompt 寫到的東西都可能被加進畫面,連寫「不要加黑背景」都可能真的加上。下 prompt 要小心,並多換 seed 和尺寸試試。
- 13:18 longest side 有快捷按鈕,也可在 settings 加入常用尺寸。VRAM 夠的話甚至能做 full HD。↳ longest side 有快捷按鈕,也能在 settings 加入常用尺寸。VRAM 夠的話,甚至可以做 full HD。
- 13:18 pixaroma.com 網站有更新。課程免費,所有集數和附帶內容都能從網站取得。↳ pixaroma.com 網站更新了。課程免費,所有集數和附帶檔案都能在網站上拿到。
- 13:18 通常每週一集,假期或作者度假時除外。下週因作者度假不會有新集數。↳ 通常每週一集,假期或作者休假時例外。下週作者去度假,不會有新的一集。
- 13:49 更多 workflows 可以看 episode 29。workflows 全部免費,本集影片上傳後會一併放上。↳ 想要更多 workflow 可以看第 29 集。workflow 全部免費,本集的會在影片上傳後一起放上。
- 13:49 網站也有 RunPod 上的雲端 workflows,以及 gems(例如本集用來生成 prompt 的那些),都是免費的。↳ 網站也有 RunPod(租用雲端顯卡的服務)上用的 workflow,以及本集寫 prompt 用的那些 gem,都免費。
- 13:49 唯一不免費的是 YouTube 與 Discord 會員,放上網站是因為很多人想支持頻道卻不知道怎麼加入。↳ 唯一要付費的是 YouTube 和 Discord(社群聊天平台)會員。放上網站是因為很多人想支持頻道,卻不知道怎麼加入。
- 14:23 最高等級是 Legends,對頻道幫助最大、福利也較多。YouTube 現在也提供免費試用。↳ 最高等級是 Legends,對頻道幫助最大,福利也比較多。YouTube 現在也有免費試用。
- 14:23 把 Discord 帳號連結到有會員的 YouTube 帳號,就能進 Discord 並取得各等級的身分組。↳ 把 Discord 帳號連結到有加入會員的 YouTube 帳號,就能進 Discord,並拿到對應等級的身分組。
- 14:23 片尾展示用 MiniMax H3 以 HD 尺寸生成的示範影片,尺寸不算大但看起來仍相當好。↳ 片尾示範了用 MiniMax H3 以 HD 尺寸生成的影片。尺寸不算大,但畫面看起來還是相當好。
📘 術語
LoRA(LoRA(加速用附加模型)):用來加速生成,把步數從 20 降到 4 或 8;放在 LoRAs 資料夾內的 H3 資料夾
VRAM(顯示記憶體):monitor 節點會顯示其用量;不夠時提高解析度可能崩潰,作者峰值約 22 GB
LoRA Loader(LoRA 載入節點):加在 diffusion model 載入之後、KSampler 之前,用來加入 LoRA
KSampler(取樣節點):LoRA Loader 要放在它之前
Shift(shift 參數):此 LoRA 以 shift 6 訓練,所以不用 ComfyUI 預設的 12,改用 6
steps(步數):4 步最快但音質差,8 步較平衡,12 步品質更好;最佳品質是不用 LoRA 跑 20 步
sampler / scheduler(取樣器/排程器):不同組合結果差很多,例如 Euler+Simple、Euler+Beta;有些組合很差應避免
seed(種子):4 步時許多 seed 音質較差;建議嘗試不同 seed 與尺寸
Kitchen Attention / Sage Attention(注意力加速選項):Kitchen Attention 已整合進 ComfyUI,Sage Attention 速度相近;用參數啟動或加節點,二選一
Version Check node(版本檢查節點):確認 ComfyUI 與 PiXarooma nodes 版本是否與作者相同或更新
git pull(git 拉取更新):手動更新 PiXarooma nodes 的方式
Fix Node Recreate(重建節點):複製節點後按右鍵選它,可看到節點預設外觀、數值與原始標題
dropdown PiXarooma node(下拉選單節點):每個選項最多可設四個輸出值(文字或數字),可放 samplers、steps、models、prompts 等
Monitor PixAroma node(監控節點):顯示 VRAM、RAM、溫度等;可隱藏數值、切換 strip 版面、縮放大小
free VRAM node(清除 VRAM 節點):接在某節點後清 VRAM,數值原樣通過不改變;缺點是模型得重新載入
VAE decode(VAE 解碼):作者把 free VRAM 節點放在它之後,也就是 workflow 最後
bypass(略過):不想讓 free VRAM 節點作用時,可右鍵選 bypass
text-to-video(文字生影片):用 prompt 生成影片;此 workflow 以 Euler+Simple 分數最高
first frame to video(首幀生影片):需保持第一幀一致;以 Euler+Beta 分數最高;比 reference 模型更遵守 prompt
first frame and last frame(首尾幀生影片):可以控制影片最後停在哪一幀
reference to video(參考圖生影片):與 first-frame 是不同模型,較有創意、能吃音訊和圖片,但可能不夠精確
longest side(最長邊):決定影片解析度;設越高越久,VRAM 不夠可能崩潰
audio fade(音訊淡入):在 save MP4 節點加 120 毫秒淡入,修正 MiniMax 影片開頭聲音過強的問題
Gemini gem(Gemini gem(自訂助手)):作者用來生成 prompt,免費,放在 pixaroma.com
Easy Installer(簡易安裝器):可從 launcher 做更新,更新 Easy Install 時也會更新 PiXarooma nodes
VRAM(顯示記憶體):monitor 節點會顯示其用量;不夠時提高解析度可能崩潰,作者峰值約 22 GB
LoRA Loader(LoRA 載入節點):加在 diffusion model 載入之後、KSampler 之前,用來加入 LoRA
KSampler(取樣節點):LoRA Loader 要放在它之前
Shift(shift 參數):此 LoRA 以 shift 6 訓練,所以不用 ComfyUI 預設的 12,改用 6
steps(步數):4 步最快但音質差,8 步較平衡,12 步品質更好;最佳品質是不用 LoRA 跑 20 步
sampler / scheduler(取樣器/排程器):不同組合結果差很多,例如 Euler+Simple、Euler+Beta;有些組合很差應避免
seed(種子):4 步時許多 seed 音質較差;建議嘗試不同 seed 與尺寸
Kitchen Attention / Sage Attention(注意力加速選項):Kitchen Attention 已整合進 ComfyUI,Sage Attention 速度相近;用參數啟動或加節點,二選一
Version Check node(版本檢查節點):確認 ComfyUI 與 PiXarooma nodes 版本是否與作者相同或更新
git pull(git 拉取更新):手動更新 PiXarooma nodes 的方式
Fix Node Recreate(重建節點):複製節點後按右鍵選它,可看到節點預設外觀、數值與原始標題
dropdown PiXarooma node(下拉選單節點):每個選項最多可設四個輸出值(文字或數字),可放 samplers、steps、models、prompts 等
Monitor PixAroma node(監控節點):顯示 VRAM、RAM、溫度等;可隱藏數值、切換 strip 版面、縮放大小
free VRAM node(清除 VRAM 節點):接在某節點後清 VRAM,數值原樣通過不改變;缺點是模型得重新載入
VAE decode(VAE 解碼):作者把 free VRAM 節點放在它之後,也就是 workflow 最後
bypass(略過):不想讓 free VRAM 節點作用時,可右鍵選 bypass
text-to-video(文字生影片):用 prompt 生成影片;此 workflow 以 Euler+Simple 分數最高
first frame to video(首幀生影片):需保持第一幀一致;以 Euler+Beta 分數最高;比 reference 模型更遵守 prompt
first frame and last frame(首尾幀生影片):可以控制影片最後停在哪一幀
reference to video(參考圖生影片):與 first-frame 是不同模型,較有創意、能吃音訊和圖片,但可能不夠精確
longest side(最長邊):決定影片解析度;設越高越久,VRAM 不夠可能崩潰
audio fade(音訊淡入):在 save MP4 節點加 120 毫秒淡入,修正 MiniMax 影片開頭聲音過強的問題
Gemini gem(Gemini gem(自訂助手)):作者用來生成 prompt,免費,放在 pixaroma.com
Easy Installer(簡易安裝器):可從 launcher 做更新,更新 Easy Install 時也會更新 PiXarooma nodes
✏️ 小考一題
影片中,加入加速 LoRA 後,作者把 shift 設成多少?
A. 6B. 20C. 12D. 8看答案
答案:A。[01:35] Claude 發現這個 LoRA 是用 shift 6 訓練的,所以不用 ComfyUI 預設的 12,改用 6。
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰