AI 課本 › 🟢 API 開發

Build Hour:用 GPT-5.6 做 Valuemaxxing(價值最大化)(第 2/5 段)

2026/07/24 · 54 分鐘 · 官方字幕實證
Codeex 省錢省時技巧,以及 API 快取、程式化工具呼叫、壓縮等功能的實測
💡 你可以怎麼用:下次用 Codeex,先選 Soul 加中等推理,做不好再往上調;趕時間才開 Fast mode。也把你的 agents.md 拿出來讀一遍,刪掉現在模型已經不需要的叮嚀。
看全部 39 條重點

🧑‍🏫 這段講兩件事。第一,用 Codeex 寫程式時,怎麼調設定才不會白白浪費錢和時間。第二,用 OpenAI API 做產品的人,可以用哪些新功能省 token。講者也實際跑了測試、比較數字,很適合覺得「AI 好用但好貴」的人。

📘 術語
reasoning level(推理層級):模型推理的強度,可分中等、最高或輕量;越高越周全,但更耗資源
benchmark(基準測試):講者說需要自己的 benchmark 和評估來衡量模型表現
Fast mode(快速模式):執行速度快 1.5 倍,但使用額度消耗較快
automatic approval(自動核准):由另一個模型檢查動作是否安全,免去每個動作都要求權限
full access(完全存取):Codeex 的一種權限模式,講者說目前不建議使用
Chronicle(Chronicle(功能名)):Codeex 新功能,可錄螢幕並為任務建立記憶
agents.md(agents.md 指示檔):給模型的指示檔,建議檢視是否有過時或可精簡的內容
skills(技能):與 agents.md 一起建議重新檢視的指示內容
input tokens / output tokens(輸入/輸出 token):送進模型與模型產出的 token,精簡或改用新功能可省下
programmatic tool calling(程式化工具呼叫):模型在 JavaScript sandbox 寫程式,由 sandbox 呼叫工具並計算
sandbox(沙盒):給模型執行程式碼的 JavaScript 環境
chain of thought(思考鏈):模型的推理過程,程式化工具呼叫會把其中的工作移到 sandbox
prompt caching(prompt 快取):快取 prompt 中不變的部分以省時間和 token,5.6 後可指定要快取哪些部分
sustained reasoning(持續推理):API 可保存推理步驟,而不只有摘要,能提升一致性與快取效率
compactness / compression(壓縮):自動或透過 API 手動壓縮內容,減少每次送出的輸入量
A/B testing(A/B 測試):比較使用與不使用某功能的結果
latency(延遲):等待回應的時間,快取可減少幾秒
✏️ 小考一題

在 prompt caching 的 A/B 測試中,使用快取後 input 成本下降了多少?

A. 約 50%B. 約 24%C. 約 90%D. 約 72%
看答案
答案:C。[19:26] 字幕:input costs decreased by 90% when using the cache。24% 是 programmatic tool calling 省下的 input tokens [20:27],72 是壓縮測試中先前步驟的數量 [21:28]
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。