AI 課本 › 🎛️ ComfyUI 工作流

MiniMax Music 3 + 本機 AI Prompt 產生器(Ep31)(第 2/3 段)

2026/08/20 · 31 分鐘 · 字幕實證
用 AI Prompt 節點產生 caption 與歌詞,接進 MiniMax Music 3 工作流生成歌曲
💡 你可以怎麼用:先用 30 秒、固定 seed 跑一版,歌被切掉就縮短歌詞,太短就加句子;調到滿意再把音樂端的 seed 改成隨機,多產幾個版本挑一首。沒有收尾的話,就在音樂編輯軟體裡補淡出。
看全部 50 條重點

🧑‍🏫 這段示範怎麼用一個 AI Prompt 節點自動寫出歌曲描述和歌詞,再接進 MiniMax Music 3 的工作流直接做出歌。節點是畫面上一個個功能方塊,用線接起來就組成工作流。影片也講清楚一件事:「長度」為什麼很難剛好控制住,想用免費模型做 AI 歌曲的人值得先知道。

📘 術語
formula(公式/指示模板):節點裡可編輯的 caption 與 lyrics 指示設定,依模型不同而不同;MiniMax 要選對應的 formula
caption(歌曲描述):先產生的歌曲描述,歌詞再依它產生;MiniMax 喜歡詳細的 caption
lyrics(歌詞):依 caption 產生;長短會影響歌曲長度,instrumental 時為方括號 instrumental
verse / chorus(主歌/副歌):30 秒歌詞中有一段短 verse 和一段 chorus;10 秒版沒時間唱到 chorus
instrumental(純音樂):不需要歌詞、只跑一次,所以較快;實際長度較隨機
duration(時長):是最長長度上限,實際長度取決於歌詞、BPM、caption;自訂最高 300 秒
BPM(每分鐘拍數):字幕列為影響實際歌曲長度的因素之一
seed / fixed seed(種子/固定種子):不同 seed 會產生不同結果與長度;建議用 fixed seed 邊調整邊試
Re-roll(重擲):即使設了 fixed seed 也會更換 seed,重新產生新結果
Free VRAM(釋放顯示記憶體):執行完後釋放 VRAM;工作流 crash 時可啟用,讓它產生 prompt 後卸載模型
diffusion model(擴散模型):MiniMax Music 3 的 diffusion model 很小,可改用 FP16 版本
FP16 / INT8(模型精度版本):FP16 是可選的替代版本;作者有 INT8 時通常會先試
text encoder(文字編碼器):比較大,不能用來產生 prompt,接到 AI Prompt 節點不會運作
VAE(VAE 模型):工作流中有一個小的 VAE model,用於音訊解碼
dynamic tiled audio decode(動態分塊音訊解碼):較長的歌卡住時啟用;VRAM 多可用 normal audio decode
K sampler(K 取樣器節點):要接上 seed;設 random seed 時同一 prompt 可做出不同的歌
group(節點群組):可展開修改設定再收合,把 model loader 放進去收合讓工作流變小
outro(尾奏):30 秒版本沒有類似 outro 的結尾,可在音樂編輯軟體淡出
✏️ 小考一題

在 AI Prompt 節點中,自訂 duration 最高可以設到幾秒?

A. 600 秒B. 300 秒C. 120 秒D. 60 秒
看答案
答案:B。[12:11] 可用按鈕切換 duration,或自行輸入自訂 duration,最高 300 秒(up to 300 seconds)
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。