MiniMax Music 3 + 本機 AI Prompt 產生器(Ep31)(第 1/3 段)


🏦 台灣Pay 銀行轉帳 💙 PayPal
更新 ComfyUI 後,用新節點在本機以 AI 產生 prompt,並準備 MiniMax 音樂 prompt
- 00:00 本集主題:MiniMax Music,以及用作者新做的節點在本機以 AI 產生 prompt
- 05:37 模型選項反灰,是因為已選用和 Crea 2 workflow 相同的模型;同一模型不必載入兩次,速度較快
- 10:05 測試後,3.5 4B 模型的結果最接近需求;試過 2B 和 9B,4B 比較穩定,也比 9B 小,整個 formula 都圍繞它設計
💡 你可以怎麼用:先更新 ComfyUI 和 Pixorama Nodes,接著在 AI prompt 節點選一個內建 preset,在 idea 欄打一句話按 generate,看它擴寫出的長 prompt。想要多個版本就把 seed 改成 random,再用 save text pixaroma 存起來,慢慢從中學寫法。
看全部 49 條重點
🧑🏫 這段教你把 ComfyUI 更新到新版,再用作者新做的 AI prompt 節點,在自己電腦上把一句簡單想法擴寫成詳細的生圖 prompt,最後開始準備 MiniMax 音樂的 prompt。如果你常卡在不知道怎麼寫長 prompt,這個節點能直接幫你寫,還附上作者測過的現成寫法。
- 00:00 本集主題:MiniMax Music,以及用作者新做的節點在本機以 AI 產生 prompt↳ 這集有兩個主軸:一是 MiniMax Music(用 AI 產生音樂的模型),二是作者新做的節點,讓你在自己電腦上用 AI 幫忙寫 prompt(給 AI 的文字指令)。
- 00:00 開始前要先更新 ComfyUI 和 Pixorama Nodes;用 launcher 的 easy installer 的話,按 easy install 等它裝好更新↳ 動手前先更新 ComfyUI(一格一格拼「節點」來跑 AI 的軟體)和作者的 Pixorama Nodes 擴充。如果用 launcher 的 easy installer,按 easy install 等它跑完就好。
- 00:00 進階更新可選 update ComfyUI,或更新 ComfyUI stable/nightly 版本↳ 想自己決定怎麼更新,可以選 update ComfyUI,或指定 stable(穩定版)、nightly(每天推出的最新測試版)。
- 00:36 更新後可用新的 attention,類似 Sage attention,但內建於 ComfyUI;以前跑不動 Sage attention 的人應該可以用↳ 更新後多了一種新的 attention(模型運算的核心環節,換做法會影響速度)。它跟 Sage attention 類似,但已經內建在 ComfyUI 裡,以前跑不動 Sage attention 的人應該能用。
- 00:36 啟動 ComfyUI 時會顯示正在使用 ComfyUI kitchen attention↳ 啟動 ComfyUI 時,訊息裡會寫正在使用 ComfyUI kitchen attention。看到這行,就代表新的內建 attention 已經啟用。
- 00:36 作者加了 version check 節點顯示錄影時的版本,ComfyUI 與 Pixorama nodes 都需要該版本或更新版本↳ 作者放了一個 version check 節點,會顯示他錄影時用的版本。你的 ComfyUI 和 Pixorama nodes 都要是這個版本或更新,才跟得上教學。
- 01:09 下載 workflows;本集測試幾種 AI prompt 產生器、MiniMax 音樂生成及其 prompt↳ 先下載作者準備好的 workflows(存好的整套節點流程)。這集會試幾種 AI prompt 產生器,也會做 MiniMax 音樂和它專用的 prompt。
- 01:09 新節點 AI prompt Pixorama 可協助寫 prompt;VRAM 夠的話可接到支援 prompting 的 clip model(不是每個都支援)↳ 新節點 AI prompt Pixorama 會幫你寫 prompt。顯示卡記憶體(VRAM)夠的話,可以接上一個 clip model(負責處理文字的模型)來寫,但不是每個 clip model 都支援。
- 01:09 也可以不接線,改到 settings 選模型,可看到模型名稱、大小等資訊↳ 不想拉線也可以,直接到節點的 settings 裡挑模型。那裡會列出模型名稱、檔案大小等資訊,方便你判斷電腦撐不撐得住。
- 01:09 要知道每個模型能做什麼,只能實際測試並找出適合它的 formula↳ 每個模型擅長什麼、吃哪種寫法,沒有捷徑可抄,只能實際跑跑看,慢慢摸出一套對它有效的 formula(固定的提示寫法)。
- 01:42 作者花了幾天測試,節點已內建一些 formula 當成 presets,可直接選用,也可以加入自己的↳ 作者已經花好幾天測試,把有效的 formula 做成 presets(預設組合)內建在節點裡,點一下就能用。你也可以加入自己寫的。
- 01:42 例如用 Krea workflow 時可選對應 formula,它是在 Qwen 3 VL version 4b 上測試的↳ 舉例來說,用 Krea(一種生圖模型)的 workflow,就選對應的 formula。這套是在 Qwen 3 VL 4b 上測出來的;VL 代表能看圖也能處理文字,4b 指模型的規模。
- 01:42 模型要完全相同 formula 才會照預期運作;換成 Heretic 或其他版本結果可能不同↳ formula 和模型是綁在一起的,要用跟作者一模一樣的模型才會照預期運作。換成 Heretic 或其他改版,同一套寫法跑出來可能就不一樣。
- 02:17 選 preset 時會同時選好對應模型,節點就設定好 formula 和模型↳ 選 preset 時,節點會順便把對應的模型也選好,formula 和模型一次設定完成,不用自己配對。
- 02:17 在 idea 欄輸入想法(例:a cute cartoon cat)按 generate,幾秒後得到更長、更詳細的 prompt,耗時依電腦而定↳ 在 idea 欄打一句簡單想法,例如「a cute cartoon cat」,按 generate,幾秒後就會擴寫成又長又細的 prompt。要花多久看你的電腦效能。
- 02:17 可用 copy 按鈕複製 prompt,也可把 output 接到 workflow 或其他節點,例如 show text 節點↳ 寫好的 prompt 可以按 copy 複製到別處用,也可以把 output 接到 workflow 裡的其他節點,例如接 show text 節點直接顯示出來。
- 02:48 seed 固定時重跑結果不變;這在 workflow 很實用,因為不會每次都跑模型,可改換 k-sampler 的 seed↳ seed(隨機種子,決定這次的隨機結果)固定時,重跑會拿到同一段 prompt,模型也不用每次重跑。想換一張圖,改 K sampler(實際生圖的節點)的 seed 就好。
- 02:48 seed 可改成 random,每次產生不同 prompt;新節點 save text pixaroma 可收集這些 prompt↳ 把 seed 改成 random,每次都會產生不同的 prompt。再搭配新節點 save text pixaroma,就能把這些 prompt 收集起來。
- 02:48 另有同樣給 Krea、但改用 3.5 模型的 preset↳ 同樣給 Krea 用的,另外還有一個改用 3.5 版模型的 preset。
- 03:20 若已有該模型會自動選好,沒有的話可以先下載再選↳ 選 preset 時,如果電腦裡已經有對應模型,會自動幫你選好;還沒有的話,先下載模型再回來選。
- 03:20 VRAM 較少可開 free VRAM:每次執行後釋放 VRAM,但會變慢;大型 workflow 可為之後的生成模型騰出空間↳ VRAM 不夠可以開 free VRAM:每跑完一次就清空顯示卡記憶體,代價是變慢。跑大型 workflow 時,可以替後面的生圖模型騰出空間。
- 03:20 在 settings 點 edit 可以看到並修改作者用的 formula↳ 在 settings 按 edit,就能看到作者寫的 formula 全文,也可以直接修改。
- 03:54 自訂 preset 流程:寫 formula、儲存、測試、調整到效果好,並調整 temperature↳ 自己做 preset 的流程:寫 formula、存檔、實際測試,不滿意就改,一直調到效果好為止。過程中也要調 temperature(控制回答要保守還是發散)。
- 03:54 temperature 常用 0.3 到 0.7;數值低結果較一致,數值高結果變化較多↳ temperature 常用 0.3 到 0.7。數值低,每次結果比較接近;數值高,變化比較多。
- 03:54 按 save preset 儲存;建議名稱包含模型名稱,才知道它搭配哪個模型↳ 調好後按 save preset 存起來。名稱最好寫進模型名,以後才記得這套 formula 是搭哪個模型用的。
- 05:00 自訂 preset 會出現在 mine 分頁;在 all 分頁中 Pixaroma formula 標橘點,自訂的標灰點↳ 自己存的 preset 會出現在 mine 分頁。在 all 分頁裡,作者內建的 formula 標橘點,你自訂的標灰點,一眼就分得出來。
- 05:00 在下拉選單按 X 可刪除 preset,會先跳出確認;想了解更多可看 help 按鈕↳ 不要的 preset 在下拉選單按 X 就能刪除,刪之前會先跳出確認。想知道更多用法可以按 help 按鈕。
- 05:00 可以串接多個節點:一個產生 prompt,一個做變化版本,一個替換角色等↳ 節點可以一個接一個串起來:第一個寫 prompt,第二個做變化版本,第三個把角色換掉,各做各的工作。
- 05:00 實例:在 Crea 2 workflow 中使用,作者改了 AI prompt 節點的標題,方便閱讀 workflow↳ 實際示範是放進 Crea 2 的 workflow。作者把 AI prompt 節點的標題改掉,整張流程圖讀起來比較清楚。
- 05:37 模型選項反灰,是因為已選用和 Crea 2 workflow 相同的模型;同一模型不必載入兩次,速度較快↳ 這時模型選項是反灰的,因為它直接沿用 Crea 2 workflow 已經在用的同一個模型。同一個模型不必載入兩次,跑起來比較快。
- 05:37 執行時先依簡短想法產生長 prompt,再生成圖片↳ 按下執行後分兩步:先把你的短短想法擴寫成長 prompt,再拿這段 prompt 去生圖。
- 05:37 遇到 Crea 2 enhancer 的錯誤(不是作者的節點);作者碰到節點錯誤會先試試更新能否解決↳ 途中跳出 Crea 2 enhancer 的錯誤,那不是作者的節點。作者遇到節點出錯的習慣是:先更新看看能不能解決。
- 06:16 修法:Manager → custom nodes manager → 搜尋該節點 → try update → 重啟 ComfyUI → 重新載入↳ 更新步驟:開 Manager(管理擴充的選單)→ custom nodes manager → 搜尋出錯的節點 → 按 try update → 重啟 ComfyUI → 重新載入頁面。
- 06:46 修好後通過 K sampler,順利出圖;改變 AI prompt 的 seed 會得到不同的長 prompt↳ 修好後,流程順利跑過 K sampler 並出圖。把 AI prompt 節點的 seed 換掉,就會得到另一段不同的長 prompt。
- 06:46 示範逐步修改想法(加粉紅眼鏡、讓人物更年輕),簡單 prompt 就能得到更詳細的結果,搭配 Crea 2 效果不錯↳ 作者一步步改想法,例如加上粉紅眼鏡、讓人物年輕一點。只寫短短一句,就能換到細節豐富的 prompt,搭配 Crea 2 效果不錯。
- 07:22 結果不理想就改 seed 或 prompt;在 settings 一定要讓 formula 和模型相符,這個 formula 用的是 heretic 版本↳ 結果不理想就換 seed 或改想法。settings 裡的 formula 一定要和模型對上,這套 formula 用的是 heretic 版本的模型。
- 07:22 除了從想法產生 prompt,也能從圖片產生:多加一個 load image 節點接到 image 輸入↳ 除了用文字想法,也可以從一張圖產生 prompt:多加一個 load image(載入圖片)節點,接到 AI prompt 節點的 image 輸入。
- 07:22 也可以用 Gemma 4 從影片或音訊取得 prompt(本集沒有時間示範)↳ 用 Gemma 4(Google 出的模型)還可以從影片或音訊檔取得 prompt,不過這集沒時間示範。
- 07:22 圖片轉 prompt 範例使用 Crea 2 prompt from an image preset,同樣是 4B 模型↳ 圖片轉 prompt 的範例用的是 Crea 2 prompt from an image 這個 preset,搭配的一樣是 4B 模型。
- 08:02 圖片轉 prompt 時 idea 欄要留空,填了文字就不會運作;比例和尺寸可以自由調整↳ 從圖片產生 prompt 時,idea 欄一定要留空,只要填了字就不會運作。生出來的圖,比例和尺寸都可以自己調。
- 08:02 效果依圖片和 seed 而定;workflow 不是直接看圖,只拿到描述圖片的 prompt,所以結果還算不錯↳ 效果會隨圖片和 seed 而不同。要知道生圖流程其實沒看到原圖,只拿到一段描述原圖的文字,能做到這樣已經算不錯。
- 08:32 Z image turbo 文生圖範例:用另一個沒有視覺能力的 4B 模型,搭配 Z image 效果不錯,並選用對應的 Z image formula↳ Z image turbo(另一個生圖模型)的文生圖範例:換用另一個不會看圖的 4B 模型,選對應的 Z image formula,效果也不錯。
- 08:32 模型越聰明 prompt 越好,但聰明的模型通常也比較大,速度與品質之間總要取捨↳ 模型越聰明,寫出來的 prompt 越好;但聰明的模型通常也比較大。速度和品質之間,總要做取捨。
- 09:02 另外指定 clip model 寫 prompt 時,會同時載入 workflow 的 clip 和新選的模型,需要更多 VRAM;也可以開 free VRAM↳ 如果另外指定一個 clip model 來寫 prompt,會同時載入 workflow 原本的 clip 和新選的模型,需要更多 VRAM;不夠時可以開 free VRAM。
- 09:02 換模型前可先 unload models,重新開始↳ 換模型之前,可以先按 unload models 把已載入的模型清掉,重新開始。
- 09:02 MiniMax 音樂的 prompt 分成 caption 和 lyrics 兩部分,不是單一 prompt,要先學會怎麼寫↳ MiniMax 音樂的 prompt 不是一整段話,而是分成 caption(描述這首歌的說明文字)和 lyrics(歌詞)兩部分,要先學會兩邊各怎麼寫。
- 09:32 使用 Minimax music caption and lyrics generator,裡面用了新節點 Music Prompt Pixelroma↳ 這部分用的是 Minimax music caption and lyrics generator 這個 workflow,裡面用到另一個新節點 Music Prompt Pixelroma。
- 10:05 測試後,3.5 4B 模型的結果最接近需求;試過 2B 和 9B,4B 比較穩定,也比 9B 小,整個 formula 都圍繞它設計↳ 作者測過 2B、4B、9B,3.5 版的 4B 最接近需求:結果比較穩定,又比 9B 小,所以整套 formula 都圍繞它設計。
- 10:05 之後會示範給 ChatGPT 和 Gemini 用的 formula;settings 中已存有 Minimax Music 3 formula↳ 之後還會示範給 ChatGPT 和 Gemini 用的 formula;settings 裡已經存好 Minimax Music 3 formula,可以直接選用。
📘 術語
Sage attention(Sage attention(注意力機制)):字幕只說新的內建 attention 和它類似,但新的整合在 ComfyUI 裡
ComfyUI kitchen attention(ComfyUI kitchen attention):更新後 ComfyUI 啟動時顯示正在使用的內建 attention
stable / nightly(穩定版/每日版):更新 ComfyUI 時可選的進階更新選項
VRAM(顯示記憶體):VRAM 夠才能接其他 clip model;不夠可開 free VRAM
clip model(clip 模型):可接到 AI prompt 節點做 prompting,但不是每個都支援
formula / preset(公式/預設):作者測試後存成 preset 的提示公式,要搭配測試時用的同一個模型
seed(種子):固定時重跑結果不變,改成 random 則每次產生不同 prompt
free VRAM(釋放顯示記憶體):每次執行後釋放 VRAM,但會變慢
temperature(溫度):控制模型的可預測性或創意;低值較一致,高值較多變化
K sampler(K 取樣器):字幕提到可改它的 seed,通過它之後就生成出圖片
custom nodes manager(自訂節點管理器):在 Manager 裡搜尋節點並按 try update 更新
caption and lyrics(描述與歌詞):MiniMax 音樂 prompt 的兩個部分
ComfyUI kitchen attention(ComfyUI kitchen attention):更新後 ComfyUI 啟動時顯示正在使用的內建 attention
stable / nightly(穩定版/每日版):更新 ComfyUI 時可選的進階更新選項
VRAM(顯示記憶體):VRAM 夠才能接其他 clip model;不夠可開 free VRAM
clip model(clip 模型):可接到 AI prompt 節點做 prompting,但不是每個都支援
formula / preset(公式/預設):作者測試後存成 preset 的提示公式,要搭配測試時用的同一個模型
seed(種子):固定時重跑結果不變,改成 random 則每次產生不同 prompt
free VRAM(釋放顯示記憶體):每次執行後釋放 VRAM,但會變慢
temperature(溫度):控制模型的可預測性或創意;低值較一致,高值較多變化
K sampler(K 取樣器):字幕提到可改它的 seed,通過它之後就生成出圖片
custom nodes manager(自訂節點管理器):在 Manager 裡搜尋節點並按 try update 更新
caption and lyrics(描述與歌詞):MiniMax 音樂 prompt 的兩個部分
✏️ 小考一題
使用 AI prompt 節點「從圖片產生 prompt」時,idea 欄應該怎麼處理?
A. 填入圖片的檔名B. 留空,填文字就不會運作C. 填入 seed 數值D. 填入想要的風格關鍵字看答案
答案:B。字幕 [08:02] 說明加入文字就不會運作,要讓 idea 欄留空;[08:32] 再次提醒記得留空
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰