AI 課本 › 📺 Agents

讓 agent 自我學習的 memory 與 dreaming(第 2/2 段)

2026/05/08 · 24 分鐘 · 官方字幕實證
介紹 dreaming 如何在背景整理多個 agent 的 memory,並示範 SRE agent 的實際運作
💡 你可以怎麼用:如果你常用 Claude 做同一類工作,可以學 dreaming 的做法:每次做完請它整理「這次踩了什麼坑、哪些做法有效」;每週再把這些筆記合併、刪掉過時的,存成一份固定筆記,下次開工時先貼給它看。
看全部 50 條重點

🧑‍🏫 這段接著上半場,介紹 Anthropic 的 dreaming 功能。agent 是能自己動手完成任務的 AI 助理,memory 是它累積下來的工作筆記;dreaming 就是在 agent 下班後,另外找時間幫它整理這些筆記。後半段用一個處理系統警報的示範,實際展示一群 agent 怎麼靠整理過的記憶越做越好。

📘 術語
dreaming(作夢(記憶整理流程)):批次、非同步的背景流程,檢視近期 transcripts,找出錯誤和有效策略來更新 memory
batch asynchronous process(批次非同步流程):和特定 session 的任務工作分開執行的流程
cron(排程):字幕說可以像 cron 一樣定期啟動 dreaming
transcript(對話紀錄):agent 工作過程的紀錄,dreaming 會讀它找出 learnings
memory state(記憶狀態):dreaming 產出的更新版本,可以直接套用或先審查
memory store(記憶庫):掛在 agent 上的記憶儲存,可設為 read-only 或 read-write
out of band(帶外(在任務之外)):在 agent 處理特定 session 或任務的情境之外進行
multi-agent system(多 agent 系統):dreaming 可以同時看多個 agent,找出共同模式
harness(agent 執行框架):字幕從 harness 設計角度說,agent 需要明確、單一的目標
hot path(關鍵執行路徑):agent 執行既有任務的主要路徑,dreaming 不會增加它的延遲
test time compute(推論時運算):讓模型探索、花更多 token 以得到更好結果,拿來類比 dreaming
index(索引):像搜尋系統一樣事先建立,檢索時就能快速取得最新結果
amortize(攤提):把整理 memory 的成本分攤到所有讀取該 memory store 的 agent
frontier memory system(前沿記憶系統):memory 負責即時讀寫,dreaming 負責驗證、組織、補充,兩者合起來的系統
primitive(基本元件):memory 是讓 agent 在任務中即時讀寫、記住事情的基本元件
enrich and backfill(充實與回補):依據 agent 當天的任務,把額外資訊補進 memory
knowledge base(知識庫):上千個 agent 共享狀態後,memory 會變成大型知識庫
SRE agent(SRE agent):demo 中監看 alerts、啟動 agent 做 triage 或提交 PR 的 agent
triage(分流診斷):SRE agent 收到 alert 後啟動 agent 做的初步調查工作
runbook(操作手冊):放在 read-only 的 org-wide knowledge memory store 裡
SLO guidelines(SLO 準則):放在 org-wide knowledge memory store 裡、很少更新的內容
read-only / read-write(唯讀/可讀寫):org-wide 是唯讀,不希望 agent 修改;SRE memory store 可讀寫,agent 會持續更新
P1(P1 等級警報):demo 中從 dispatch service 傳來的 alert
diff(差異紀錄):寫入 memory store 的變更,dreaming 也會產出一組更新檔案的 diff
short-circuit(捷徑跳過):後來的 agent 讀到筆記後,不必重做同樣的調查
version history(版本歷史):可以回溯每次更新改了什麼、哪個 agent 改的、什麼時候寫的
precondition hash(前置條件雜湊):用來做 optimistic concurrency,覆寫前先確認內容沒被改過
optimistic concurrency(樂觀並行控制):修改後、覆寫之前先驗證內容是否仍是原本的樣子
subagent(子 agent):dreaming job 會啟動一批 subagents 讀 transcripts、找出 learnings
retry logic(重試邏輯):dreaming 推測 60 秒的模式可能來自低效的 retry logic
deduplication(去重):把五筆相同的條目合併成一筆
stale entry(過時條目):已經失效、不再相關的內容,dreaming 會把它移除
verification note(驗證註記):註明根據某份 transcript 確認這筆 memory 正確,隔天可以依賴
✏️ 小考一題

在 demo 的 dreaming 結果中,dreaming 發現許多 SRE agent 都在上游 CPU 飆高後多久被觸發,並推測可能有低效的 retry logic?

A. 5 分鐘B. 7 天C. 60 秒D. 30 秒
看答案
答案:C。[21:28] 字幕說 agent 都在 upstream spike 後「exactly 60 seconds」被觸發;[22:00] 字幕說 dreaming 推測可能有低效的 retry logic,而個別 agent 看不出這個 60 秒的模式。「7 天」是 dreaming job 回顧的 sessions 範圍([20:57]),不是答案。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。