AI 課本 › 📺 提示與選模型

思考的槓桿(The thinking lever)(第 1/2 段)

2026/05/08 · 24 分鐘 · 官方字幕實證
Claude 怎麼在推論時花 token 解題,以及使用者怎麼用 effort 和 budget 影響它
💡 你可以怎麼用:簡單的小事(查個資料、改一句話)用低 effort,速度快也省錢;重要又複雜的任務就調高 effort。如果工具有預算設定,可以給它設個 token 或時間上限,要它超過之前先回來問你。
看全部 34 條重點

🧑‍🏫 這支影片講的是 Claude 在回答你的當下,怎麼花力氣想和做,才能解決困難問題。講者用同一個指令做對照:讓 Claude 多花時間,成果就明顯變好。影片也說明你可以用 effort 和 budget 決定它要多認真、最多能花多少。常用 AI 的人看完,比較知道什麼時候該讓它慢慢想、什麼時候要它快點交差。

📘 術語
test time compute(測試階段算力(推論時算力)):Claude 在推論時為了解決問題而花費的任何形式的 token
inference time(推論階段):模型實際處理問題的階段,和 test time 指的是同一件事
reasoning models(推理模型):擴展 test time compute 後產生的模型,以 thinking tokens 為基礎
agentic coding evaluation(代理式寫程式評測):圖表用來比較 Haiku、Sonnet、Opus 分數的評測
effort(努力程度(旋鈕)):告訴 Claude 要怎麼在時間、成本、品質之間取捨;有 low、high、max 等等級
output tokens(輸出 token):範例用來衡量工作量,例如 low effort 約 4,600 個
intelligent driver model(智慧駕駛模型):Opus 自稱實作的模型,讓每台車依周圍車輛的動態做出反應
thinking tokens(思考 token):Claude 的內心獨白,用來逐步推理、比較選項
chain of thought(思維鏈):thinking tokens 裡逐步推理的做法
scratch pad(草稿區):Claude 需要把問題想清楚時用的空間
tool calling tokens(工具呼叫 token):Claude 和外界互動的方式,例如搜尋、讀寫檔案
text tokens(文字 token):Claude 和使用者溝通的方式:回報進度、總結、回答
task budgets(任務預算):設定 Claude 做一個任務最多能花多少 token;budget 也可以用時間或成本計
interleaved thinking(交錯式思考):讓 Claude 在工具呼叫之間思考
adaptive thinking(自適應思考):Claude 可以在任何適當的時機思考,何時想、想多少、順序都不受限;簡單問題也可以不想
✏️ 小考一題

在紅綠燈模擬的例子中,Opus 4.7 用 max effort 時,花的時間和 token 大約是 low effort 的幾倍?

A. 10 倍B. 100 倍C. 5 倍D. 2 倍
看答案
答案:A。[04:14] 講者說 max effort 下 Opus 4.7 花的時間和 token 都是 low effort 的 10 倍(2 倍是 high effort,見 [03:44])
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。