AI 課本 › 📺 客戶案例

在 Claude 模型正式推出前,這些團隊會先試著把它弄壞

2026/05/28 · 3 分鐘 · 官方字幕實證
搶先測試新 Claude 模型的客戶,分享測試方法、模型的進步和合作心得
💡 你可以怎麼用:把妳常請 AI 做的工作整理成 5~10 題的「小考卷」,順便記下妳滿意的答案長什麼樣子。之後每次有新模型推出就重考一遍,特別看看以前做不好的那幾題有沒有進步。
看全部 7 條重點

🧑‍🏫 這支影片訪問了幾家搶先拿到新 Claude 模型的企業客戶,讓他們分享正式推出前怎麼測試模型、看到哪些進步,以及跟 Anthropic 怎麼合作。適合想知道新模型是怎麼被檢驗出來的人,也能看出該怎麼判斷一個新模型到底強在哪裡。

📘 術語
automated evals(自動化評測):拿到新模型後最先做的事,讓評測在背景執行
S1(S1 文件):被舉例為特別複雜的法律任務,要交給模型起草
agentic capabilities(agentic 能力):模型能自己去找需要的資訊、整合內容並編輯文件
✏️ 小考一題

影片中,客戶拿到新 Claude 模型後做的第一件事是什麼?

A. 先寫一份新模型的公開評測報告B. 啟動 automated evals,讓它們在背景執行C. 直接交給客戶在正式環境使用D. 先請模型起草一份完整的 S1
看答案
答案:B。[01:02] 提到第一件事是啟動 automated evals,讓它們在背景執行
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。