AI 課本 › 💎 研究與訪談

當數百萬個 AI agent 相遇(第 3/4 段)

2026/06/23 · 42 分鐘 · 官方字幕實證
談人機協作審核、agentic traps 的攻擊方式與多層防禦,以及 agentic economy 的拍賣設計
💡 你可以怎麼用:讓 AI 替你上網辦事時,權限給最小就好:付款、刪除、寄信這類動作設成要你按確認才執行,能動用的錢只放小額。它逛過陌生網站後如果行為跟你交代的不一樣,先停下來,別讓它繼續。
看全部 35 條重點

🧑‍🏫 這段在講 AI agent(能自己上網替你辦事的 AI)大量上路後會遇到的三件事:人跟 AI 怎麼分工審核、網路上專門坑 agent 的陷阱與防法、以及 agent 替人搶票買東西時規則怎麼訂才公平。如果你已經在讓 AI 幫你上網查資料、下單,這段講的風險跟你直接有關。

📘 術語
agentic traps(agent 陷阱):web 環境被下毒、佈下陷阱,agent 互動時踩到,惡意人士藉此入侵系統
prompt injector(提示注入器):主持人舉例:藏在網站裡、會改變 agent 目標的東西
hidden tokens(隱藏 token):網頁中不會被視覺呈現的元素,讀原始格式的 agent 可能不小心吃進去
visual computer use agent(視覺式電腦操作 agent):像人類一樣看網頁像素的 agent,而不是讀取頁面原始格式
dynamic cloaking(動態偽裝):惡意網站依行為判斷對方是人或 agent,對兩者顯示不同頁面
jailbreaking(越獄):字幕未下定義;指網站調整內容或細微改動所誘發、讓 agent 或模型受害的結果
surface area(攻擊表面積):agent 越多,惡意人士可瞄準的範圍越大
adversarial examples(對抗樣本):對影像做人類察覺不到的改動,就能 jailbreak 模型
least significant bit(最低有效位元):在多處修改編碼的這個位元,人類可能看不出來,但會影響 agent
defense through depth(縱深防禦):沒有單一解法,要一層層疊加緩解措施,讓漏網的很少
guardrails(護欄):主持人談安全時的用語,字幕未另外解釋
foundation models(基礎模型):在 agent 底層運行的模型,模型端也要有緩解措施
persistent memory(持久記憶):個人助理對你保有的記憶,藉此了解你的渴望與偏好
agentic economy(agent 經濟):個人助理拿著你給的預算替你協商,形成助理之間的在地化經濟
repeated auctions(重複拍賣):不是單一張票的單次拍賣,而是涵蓋所有購票的多次拍賣
✏️ 小考一題

依字幕,什麼是 dynamic cloaking?

A. 給每個參與拍賣的 agent 相同的預算B. 在影像中改動幾個像素,讓人類察覺不到C. agent 隱藏自己的身分,讓網站以為它是人類D. 惡意網站依頁面上的行為判斷對方是人還是 agent,對兩者顯示不同的頁面
看答案
答案:D。[25:02] 說明惡意網站可做 dynamic cloaking:對人類與 agent 顯示不同頁面,因為能從頁面上的行為猜出是人還是 agent,再針對 agent 調整內容以誘發 jailbreaking。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。