認識 GPT-5.6


🏦 台灣Pay 銀行轉帳 💙 PayPal
GPT-5.6 系列正式開放使用,並以 Codex 做卡牌遊戲示範新能力
- 00:02 GPT-5.6 系列模型今天起 generally available(全面開放使用)
- 01:03 programmatic tool calling 讓講者省下大量時間和 tokens
- 01:35 API 提供三種模型:處理高難度 agentic 工作的旗艦模型、較均衡的模型,以及處理日常任務、快速又實惠的模型
💡 你可以怎麼用:下次請 AI 做東西時,可以先丟一句簡短、開放式的需求,讓它先交出能用的第一版,再一輪一輪加要求(加功能、換風格),不用一開始就把每個細節寫死。如果工具可以選模型或思考等級,簡單的事選快又便宜的,複雜的事再開高一點。
看全部 14 條重點
🧑🏫 這支是 OpenAI 宣布 GPT-5.6 系列正式開放的影片。講者用一句很簡短的需求,讓模型從零做出一款卡牌遊戲,順便介紹幾個新能力。想知道現在的 AI 能自己把一個專案做到多完整,看這支很直觀。
- 00:02 GPT-5.6 系列模型今天起 generally available(全面開放使用)↳ 「generally available」就是正式上線、大家都能用,不再只開放給少數人搶先試用。從影片發布這天起,GPT-5.6 整個系列都正式開放了。
- 00:02 整個 GPT-5.6 系列每個 token 能提供更多智慧,面對模糊的 prompt 也更能維持在正軌上↳ token 是模型切分文字的小單位,用量和費用也是用它來算。這條的意思是:花一樣多的用量,得到更聰明的結果;就算你的 prompt(給模型的指令)寫得不清楚,它也比較不容易跑偏。
- 00:02 示範:在 Codex 裡用一段簡短、刻意開放式的 prompt,請 GPT-5.6 做一款全新的卡牌遊戲↳ Codex 是 OpenAI 讓 AI 直接動手寫程式、做專案的工具。講者故意只給一句很短、沒規定細節的要求,就是想看看模型自己能發揮到什麼程度。
- 00:02 模型自己設計核心遊戲機制、產生美術圖,並交出可運作的第一版↳ 遊戲怎麼玩、畫面長什麼樣子,都是模型自己想、自己畫,最後交出一個真的能玩的初版。它給的是能動的東西,不是企劃書或做一半的草稿。
- 00:33 接著要求模型繼續做:加入關卡、強化遊戲機制、客製化美術,並製作配樂↳ 有了初版以後,講者就像在跟團隊提新需求:再加關卡、讓玩法更有深度、美術改成專屬風格,連背景音樂也一起做。
- 00:33 講者很喜歡模型做事周全,不必自己設計每個畫面、定義每個互動,或管理一大堆 tickets↳ tickets 是專案裡用來分派和追蹤每件待辦事項的工作單。講者的意思是,以前細節要自己拆、單要一張張開、進度要自己盯,現在模型會自己把事情想周全。
- 00:33 新功能 programmatic tool calling:模型可從 sandbox 呼叫工具,減少工具輸出與 context window 之間的來回↳ programmatic tool calling 是模型用程式在 sandbox(和外部隔開的執行空間)裡呼叫工具。工具跑出來的結果先在裡面處理,不用每次都丟回 context window(模型一次能看到的內容量)來回傳。
- 01:03 programmatic tool calling 讓講者省下大量時間和 tokens↳ 資料來回傳的次數變少,等待時間就縮短,要塞給模型讀的內容也變少,所以用掉的 token 和花的錢都跟著省下來。
- 01:03 新增比 Extra High 更高的 reasoning levels,讓 GPT-5.6 有更多思考能力,也是模型做事這麼持久的原因之一↳ reasoning levels 是可以調整的「思考深度」檔位,檔位越高,模型想得越久。原本最高是 Extra High,現在又多了更高的檔位。講者認為想得更多,是它能一路把事做完的原因之一。
- 01:03 在 Codex 中,GPT-5.6 更會把工作委派給 subagents↳ subagent 是主模型派出去的小幫手,每個負責一塊工作。在 Codex 裡,GPT-5.6 更常主動把工作分給它們,不會全部自己一個人扛。
- 01:03 先前的模型也可能有委派能力,但 GPT-5.6 經過訓練,會自己判斷什麼時候委派有幫助↳ 重點不是「會不會分工」,而是「知不知道什麼時候該分」。就像能幹的主管知道哪些事交出去比較快、哪些自己做完就好,GPT-5.6 是被訓練出這種判斷力的。
- 01:03 做遊戲時,模型用 subagents 拆分工作並平行完成,例如美術和音效設計↳ 像美術和音效彼此不互相影響,就同時交給不同的 subagent 去做,不用等一件做完才開始下一件,整體速度快很多。
- 01:35 API 提供三種模型:處理高難度 agentic 工作的旗艦模型、較均衡的模型,以及處理日常任務、快速又實惠的模型↳ API 是開發者把模型接進自己產品的管道;agentic 是指 AI 自己規劃、連續做完多個步驟的任務。旗艦版負責最難的這類工作,另外還有均衡版,以及又快又便宜、適合日常小事的版本。
- 01:35 這款遊戲只是講者用 GPT-5.6 做的眾多專案之一↳ 這款卡牌遊戲只是講者用 GPT-5.6 做過的眾多專案之一。影片展示的只是一小部分,不代表它只會做遊戲。
📘 術語
token(詞元):字幕說 GPT-5.6 每個 token 能提供更多智慧,programmatic tool calling 也能省下 tokens
prompt(提示詞):給模型的指令;字幕說 GPT-5.6 就算遇到模糊的 prompt 也更能維持在正軌上
Codex(Codex):講者用 GPT-5.6 做卡牌遊戲的地方;在 Codex 裡模型也能委派工作給 subagents
programmatic tool calling(程式化工具呼叫):模型從 sandbox 呼叫工具,減少工具輸出和 context window 之間的來回,省時間也省 tokens
sandbox(沙箱):字幕說模型在 programmatic tool calling 時,是從 sandbox 呼叫工具
context window(上下文視窗):字幕提到要減少工具輸出與 context window 之間的來回
reasoning levels(推理等級):新增比 Extra High 更高的等級,讓 GPT-5.6 有更多思考能力
subagent(子代理):GPT-5.6 會自己判斷何時把工作委派給 subagents,拆開並平行完成
agentic(代理式):字幕說 API 的旗艦模型是為高難度的 agentic 工作設計的
API(應用程式介面):在 API 使用 GPT-5.6 時,可以選旗艦、均衡、快速實惠三種模型
prompt(提示詞):給模型的指令;字幕說 GPT-5.6 就算遇到模糊的 prompt 也更能維持在正軌上
Codex(Codex):講者用 GPT-5.6 做卡牌遊戲的地方;在 Codex 裡模型也能委派工作給 subagents
programmatic tool calling(程式化工具呼叫):模型從 sandbox 呼叫工具,減少工具輸出和 context window 之間的來回,省時間也省 tokens
sandbox(沙箱):字幕說模型在 programmatic tool calling 時,是從 sandbox 呼叫工具
context window(上下文視窗):字幕提到要減少工具輸出與 context window 之間的來回
reasoning levels(推理等級):新增比 Extra High 更高的等級,讓 GPT-5.6 有更多思考能力
subagent(子代理):GPT-5.6 會自己判斷何時把工作委派給 subagents,拆開並平行完成
agentic(代理式):字幕說 API 的旗艦模型是為高難度的 agentic 工作設計的
API(應用程式介面):在 API 使用 GPT-5.6 時,可以選旗艦、均衡、快速實惠三種模型
✏️ 小考一題
根據影片,GPT-5.6 在 Codex 中使用 subagents 跟先前的模型比起來有什麼不同?
A. GPT-5.6 需要使用者手動指定每個 subagent 的工作B. GPT-5.6 只能在 API 中使用 subagents,不能在 Codex 中使用C. GPT-5.6 經過訓練,會自己判斷什麼時候委派工作有幫助D. GPT-5.6 是第一個能使用 subagents 的模型看答案
答案:C。[01:03] 字幕說先前的模型也可能有委派能力,但 GPT-5.6 經過訓練,會自己判斷什麼時候委派有幫助
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰