我把 Higgsfield 和 Claude Opus 5.5 結合使用——太誇張了


🏦 台灣Pay 銀行轉帳 💙 PayPal
用同樣 prompt 透過 Higgsfield 比較 Claude Opus 5.5 與 GPT-6 Astra 的影片生成成果
- 00:00 開場兩支影片分別由 Claude Opus 5.5 和 GPT-6 Astra 製作;兩個模型都不便宜,花錢前要選對
- 06:34 最後一句「You've been gone a while, huh?」在劇本中有張力,但 Seedance 演得不好;第二輪 Astra 勝,但差距不大
- 11:17 Opus 還附上搜尋查詢,方便直接訂購所需零件自己組裝
💡 你可以怎麼用:要用 AI 做影片時,記得在指令裡寫清楚片長、每一段要發生什麼事,也要提醒它把前一段影片當參考附上,這樣成品會差很多。如果你在意點數,就明講「只要 PDF」或「不要做額外功能」,避免模型自己加碼害你多花錢。
看全部 33 條重點
🧑🏫 這支影片把同一組 prompt(給 AI 的指令文字)原封不動交給 Claude Opus 5.5 和 GPT-6 Astra 兩個 AI 模型,再透過 Higgsfield 平台產出影片和設計,比較誰做得比較好。四輪測試分別是恐怖片、分手戲、解說影片和樂高設計。如果你正在考慮花錢用哪個模型做影音內容,這支片可以讓你看到兩者實際差在哪裡。
- 00:00 開場兩支影片分別由 Claude Opus 5.5 和 GPT-6 Astra 製作;兩個模型都不便宜,花錢前要選對↳ 片頭兩支影片各由一個模型操刀。這兩個模型用起來都要花不少錢,所以作者想先比給你看,讓你付費前知道哪個比較值得。
- 00:00 作者幾週前測過 GPT-6 Astra 搭配 Higgsfield;這次把給 Astra 的 prompt 原封不動貼給 Opus 5.5 做比較,贏最多的成為 frontier models 新王↳ 作者幾週前用 Astra 測過一輪,這次拿同一批指令給 Opus 跑,條件一樣才公平。frontier models 是各家最頂尖、最新的 AI 模型,贏比較多輪的就是作者心中的新王。
- 00:30 本片由 Higgsfield 贊助;Higgsfield 的 MCP 讓 Claude 和 ChatGPT 直接存取 AI 圖片與影片模型,在聊天介面內生成,不必在多個分頁間複製貼上↳ 這支是業配。MCP 是讓 AI 聊天工具連上外部服務的接口。接上 Higgsfield 之後,你在 Claude 或 ChatGPT 聊天時就能直接叫它生圖、生影片,不用在好幾個網站之間複製貼上。
- 00:30 測試一:影片 prompting。要求 30 秒 found footage 恐怖片段,刻意寫得模糊,把敘事、鏡頭控制等交給 LLM 決定↳ 第一題是 30 秒的 found footage 恐怖片。found footage 是假裝「撿到別人拍的錄影帶」的拍法。LLM 是大型語言模型,就是會讀會寫的 AI。作者故意把指令寫得很模糊,想看 AI 自己怎麼安排劇情和鏡頭。
- 02:10 Astra 一鏡到底沒有剪接,是不錯的手法,但中間有尷尬停頓,因為 prompt 沒有足夠指示讓那段時間有動作↳ Astra 整段一鏡到底,中間沒有剪接,這個選擇本身不錯。問題是中途有一段畫面沒事發生,原因是它寫給影片模型的指令沒交代那幾秒要演什麼,畫面就空在那裡。
- 02:10 Opus 敘事推進更細:屋外夜景→開門鏡頭→切換夜視(作者覺得是好細節,但下一鏡就沒了),開場更神秘↳ Opus 把劇情拆得比較細:先拍屋外夜景,再拍開門,接著切成夜視畫面,開場比較有懸疑感。可惜夜視只出現一鏡就沒再用,作者覺得前後沒有貫徹。
- 02:40 Astra 的樓梯上詭異男子效果平淡;Opus 版本角色逃跑時仍維持 found footage 攝影機 POV,符合要求↳ 樓梯上出現怪人那段,Astra 拍得平平沒什麼嚇人效果。POV 是「第一人稱視角」,畫面就是拿攝影機那個人看到的。Opus 讓角色逃跑時鏡頭依然是他手上的攝影機,有照題目要求。
- 02:40 部分差異可能是 Seedance 2.5(字幕寫作 CDANCE/Sea Dance)替 Claude 生成得較好,所以作者不挑 Astra 版攝影機像手電筒的問題;但成品差距大,顯示 prompt 輸入影響很大↳ Seedance 是實際把文字指令變成影片的模型,兩邊的影片都靠它生成。作者承認差異可能有一部分是 Seedance 這次剛好表現得好,但兩邊成品差太多,代表 AI 寫給它的指令好不好影響很大。
- 03:14 Opus 特別要求畫面加上錄影紅點,很能營造 found footage 感;Astra 沒要求也就沒有。第一輪 Opus 輕鬆勝出↳ Opus 會主動要求畫面角落加上錄影中的紅點,一看就像真的錄影畫面。Astra 沒提這件事,畫面就沒有。光這種細節就差很多,第一輪由 Opus 輕鬆贏下。
- 03:14 測試二:較偏藝術的 prompt,寫並製作一場分手戲;GPT-Astra 這題表現大幅超越前代模型↳ 第二題比較吃文藝感:自己寫一場分手戲再拍出來。作者說 Astra 在這題的表現比 ChatGPT 以前的模型進步非常多。
- 03:46 AI 模型寫劇本常塞滿 exposition(角色說出劇情或內心想法),顯得很做作,像 Hallmark 電影或肥皂劇↳ exposition 是角色把劇情或心裡話直接講出來,例如「我好難過,因為你騙了我三年」。AI 寫劇本很常這樣,聽起來很假,像公式化的愛情電視電影或八點檔。
- 04:17 Astra 打破這個模式,成品簡潔、留白多、感覺更真實↳ Astra 這次沒有犯這個毛病,台詞短、話留一半,讓觀眾自己去感受。看起來反而比較像真實的人在分手。
- 05:22 沒限定時長,Opus 生成兩段而非一段 30 秒:好處是台詞間有呼吸空間,壞處是中間出現 jump cut↳ 作者沒有規定片長,Opus 就拆成兩段影片。好處是台詞之間有停頓、不會太趕。壞處是兩段接起來會有 jump cut,也就是畫面突然跳一下,看得出是硬接的。
- 05:22 Opus 有用角色與場景 reference 維持兩鏡一致,但要真正無縫,應切到完全不同角度(如男主臉部特寫)或用另一個角度↳ Opus 有附上角色和場景的參考圖,讓兩段裡的人和場景長得一樣。但要接得看不出痕跡,第二段最好換成完全不同的角度,例如男主角的臉部特寫。
- 06:02 應使用 Seedance 2.5 的 video reference 場景延續功能求完美連貫;劇本和 prompt 都要求 reverse shot,但 Opus 沒附原影片當 video reference,Seedance 無從參考↳ reverse shot 是對話時把鏡頭轉到對面拍另一個人。劇本有寫要這樣拍,但 Opus 沒把第一段影片附給 Seedance 當參考,Seedance 根本不知道前面長怎樣,自然接不好。
- 06:02 作者判定這個問題一半是 Seedance 的錯、一半是 Opus 的錯↳ 作者判定這個銜接問題兩邊都有責任:Seedance 本身沒處理好,Opus 也沒有把該給的參考資料附上去。
- 06:02 Opus 的對白普通:在婚禮上跳舞那句不夠力,作者認為那稱不上 AI 以為的背叛↳ Opus 寫的台詞普普通通。像「在婚禮上跟別人跳舞」這句,AI 把它當成背叛,但作者覺得這件事根本沒嚴重到算背叛,情緒張力不夠。
- 06:34 最後一句「You've been gone a while, huh?」在劇本中有張力,但 Seedance 演得不好;第二輪 Astra 勝,但差距不大↳ 結尾那句「你離開很久了吧?」寫在劇本裡其實很有味道,但 Seedance 生成的演出沒演到位。第二輪 Astra 贏,不過兩邊差距不大。
- 06:34 測試三:結合創意與技術,要求製作一支講騙子賣掉 Eiffel Tower 的 explainer video↳ 第三題要同時考創意和技術。explainer video 是解說型短片,用旁白加畫面把一件事講清楚。題目是做一支介紹「騙子把艾菲爾鐵塔賣掉」這則史上騙局的影片。
- 07:06 兩個模型都上網搜尋認出故事,請作者選旁白聲音,依 Vox 風格產生非常相似的圖片參考,再自主組裝剪輯成片↳ 兩個模型都會自己上網查到這個故事,請作者挑旁白聲音,再仿照 Vox(以圖像化解說影片出名的美國媒體)的風格產生參考圖,最後自己把片子剪好。
- 07:06 影片內容:Victor Lustig 偽造官方文件,在豪華旅館邀廢鐵商談秘密交易,說維護費太高政府要拆塔賣鐵↳ 其中一版的內容是:Lustig 偽造官方文件,在高級飯店約廢鐵商密談,謊稱政府嫌鐵塔維護費太高,打算拆掉當廢鐵賣。
- 08:09 內容續:André Poisson 上鉤並付賄款(讓 Lustig 像貪官而非冒牌貨),Lustig 帶錢逃走,Poisson 太丟臉而沒聲張↳ Poisson 信了,還付了賄款。這招很聰明,對方會以為 Lustig 是想撈錢的貪官,就不會懷疑他是假冒的。Lustig 拿到錢就跑,Poisson 覺得太丟臉,也不敢報案。
- 08:39 另一版本提到 1925 年、偽造部會信頭、召集六名廢鐵商、7,000 噸鐵、隔天截標,Lustig 搭火車去 Vienna↳ 另一版加了更多細節:1925 年、偽造政府部門的公文抬頭、找來六個廢鐵商、7,000 噸鐵、隔天就截止投標,最後 Lustig 搭火車逃到維也納。
- 09:09 該版本續:再次兜售時有商人報警,Lustig 逃到美國,後來還騙了 Al Capone↳ 這版還講到後續:Lustig 想再賣一次,這次有商人報了警,他就逃到美國,後來甚至騙到黑幫老大 Al Capone 頭上。
- 09:44 第一個版本的旁白較精緻;兩者視覺風格相近,但 Opus 版動畫稍好、整體更精緻↳ 作者覺得第一版的旁白寫得比較好。兩版畫面風格很像,但 Opus 那版的動畫稍微順一點,整體完成度也比較高。
- 09:44 Claude 未經要求主動多給一版無內建字幕的影片,作者認為非常實用;第三輪 Opus 大勝↳ 作者沒有要求,Claude 卻主動多給一版沒有燒字幕的影片。這樣之後要改字幕、翻譯或換平台發都方便,作者覺得超實用。第三輪 Opus 大勝。
- 09:44 測試四:作者最愛的複雜空間渲染任務——設計樂高橡皮鴨↳ 第四題是作者最愛的:設計一隻樂高橡皮鴨。AI 要在腦中想像積木怎麼疊、怎麼卡住,這種立體空間的推理對它來說很難。
- 10:16 之前 Astra 是作者首次看到 LLM 做出功能完整、空間正確的樂高設計,鴨子雖簡單但是一大躍進↳ 之前 Astra 是作者第一次看到 AI 設計出真的組得起來、結構也正確的樂高。那隻鴨子雖然很簡單,但已經是一大進步。
- 10:16 給 Opus 同樣 prompt,它花了將近 20 分鐘才完成↳ 同一段指令給 Opus,它花了快 20 分鐘才做完,比一般生成慢很多。
- 10:46 作者只要求說明書 PDF,Opus 卻做出整套 3D 說明介面:隨滑鼠反應、可拖曳 3D 檢視、換步驟時積木有動畫↳ 作者只要一份說明書 PDF,Opus 卻做出一整套互動式 3D 說明頁面:會跟著滑鼠動,可以拖曳旋轉看模型,換步驟時積木還會有動畫。
- 10:46 Opus 沒照指示做,害作者燒掉更多 credits;但客觀上鴨子比 Astra 的好,零件清單也準確↳ credits 是平台上用來付生成費用的點數。Opus 做了超出要求的東西,作者就多花了點數。不過客觀來說,它的鴨子比 Astra 的好看,零件清單也正確。
- 11:17 Opus 還附上搜尋查詢,方便直接訂購所需零件自己組裝↳ Opus 還附上每個零件的搜尋關鍵字,照著搜就能直接買齊積木,自己動手組。
- 11:17 結論:Opus 5.5 大勝 GPT-Astra 6,但 GPT-6 Astra 相較 ChatGPT 前代仍是很大的進步↳ 總結:四輪下來 Opus 5.5 明顯勝出。但作者也強調,GPT-6 Astra 跟 ChatGPT 以前的模型比起來,已經進步很多了。
📘 術語
MCP(MCP):Higgsfield 的 MCP 讓 Claude、ChatGPT 直接存取圖片影片模型,在聊天介面內生成
LLM(大型語言模型):字幕未解釋,指片中比較的 Claude Opus 5.5、GPT-6 Astra 等模型
frontier models(前沿模型):字幕未解釋,作者要選出其中的「新王」
found footage(偽紀錄片/發現影像):字幕未直接定義;片中以攝影機 POV、錄影紅點來營造這種感覺
POV(第一人稱視角):字幕未解釋,指 found footage 的攝影機視角
exposition(說明式對白):角色把劇情或心裡想的事直接說出口,顯得做作
jump cut(跳接):字幕未解釋;Opus 分成兩段生成,中間出現跳接
reverse shot(反打鏡頭):字幕未解釋;劇本要求,但沒附原影片,Seedance 不知道長什麼樣
video reference(影片參考):Seedance 2.5 的場景延續功能,附上原影片可達成完美連貫
explainer video(解說影片):字幕未解釋;第三輪要求做 Eiffel Tower 騙局的解說片
credits(點數):字幕未解釋;Opus 沒照指示做,讓作者燒掉更多 credits
LLM(大型語言模型):字幕未解釋,指片中比較的 Claude Opus 5.5、GPT-6 Astra 等模型
frontier models(前沿模型):字幕未解釋,作者要選出其中的「新王」
found footage(偽紀錄片/發現影像):字幕未直接定義;片中以攝影機 POV、錄影紅點來營造這種感覺
POV(第一人稱視角):字幕未解釋,指 found footage 的攝影機視角
exposition(說明式對白):角色把劇情或心裡想的事直接說出口,顯得做作
jump cut(跳接):字幕未解釋;Opus 分成兩段生成,中間出現跳接
reverse shot(反打鏡頭):字幕未解釋;劇本要求,但沒附原影片,Seedance 不知道長什麼樣
video reference(影片參考):Seedance 2.5 的場景延續功能,附上原影片可達成完美連貫
explainer video(解說影片):字幕未解釋;第三輪要求做 Eiffel Tower 騙局的解說片
credits(點數):字幕未解釋;Opus 沒照指示做,讓作者燒掉更多 credits
✏️ 小考一題
在樂高橡皮鴨測試中,Claude Opus 5.5 花了多久完成任務?
A. 大約 10 分鐘B. 將近 20 分鐘C. 超過 1 小時D. 大約 5 分鐘看答案
答案:B。[10:16] 作者說 "This thing took almost 20 minutes to complete the task."
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰