AI 課本 › 🟢 研究與安全

第 15 集:深入了解 Model Spec(第 3/3 段)

2026/03/25 · 37 分鐘 · 官方字幕實證
Jason 談 Model Spec 的定位、收錄範圍、未來走向、寫作技巧,以及和 Asimov 定律的對照
💡 你可以怎麼用:下次寫 ChatGPT 自訂指令、GPT 設定或 agents.md 時,照 Jason 的方法寫:每條都寫具體、做得到的事,不要只寫「要專業」這種空話。再補一兩個你最怕 AI 做錯的棘手例子,寫明那時該怎麼做,並留意兩條指示會不會互相衝突。
看全部 34 條重點

🧑‍🏫 這段是 OpenAI 的 Jason 在聊 Model Spec:這份規範模型行為的文件是寫給誰看的、該收哪些內容、未來會怎麼變,也分享怎麼把規則寫清楚。你平常會對 AI 下指令、寫設定,這些寫法可以直接拿來用。

📘 術語
Model Spec(模型規範):公開的行為介面,向大眾說明模型應有的行為,也讓模型能理解並套用
soul spec((Anthropic 的)soul spec):較像實作產物,用來教 Claude 認識自己的身分及如何看待世界、訓練過程與 Anthropic
implementation artifact(實作產物):Jason 用來形容 soul spec:主要作用是訓練模型,而不是對外說明
generalize(泛化):用 spec 檢查模型行為是否照預期推廣,遵守大家同意的行為
red team(紅隊測試):字幕指預先找出政策之間所有可能的交互情況
AGI(通用人工智慧):字幕的思想實驗:假設模型達到人類水準的 AGI
agent(代理):越來越自主,會在世界中和許多人及 agent 互動、交易
positive sum outcomes(正和結果):日常重視的技能之一,和信任、理解他人需求並列
agents.md(agents.md 檔案):使用 coding agent 時寫的檔案,像是專案的迷你 spec,可放進 context 讓模型遵循
coding agent(程式碼代理):字幕提到使用者會替它撰寫 agents.md
developer messages(開發者訊息):開發者在 API 上寫的訊息,用來確保得到想要的體驗
license to operate(營運許可):Spec 三大目標之一:維持 OpenAI 的營運許可
Asimov's laws(Asimov 機器人定律):服從指令、不傷害人類、不傷害自己;故事中最初是嚴格階層
strict hierarchy(嚴格階層):依一、二、三順序絕對優先;Spec 的三個目標不採用這種方式
zeroth law(第零定律):主持人提到 Asimov 越想越多,後來加上的定律
✏️ 小考一題

根據 Jason 的說法,Model Spec 開頭列出的三個部署目標(賦能使用者與開發者、保護社會免於嚴重傷害、維持 OpenAI 營運許可)彼此是什麼關係?

A. 像 Asimov 定律一樣,依一、二、三順序嚴格優先B. 排序交給開發者在 developer messages 中自行決定C. 保護社會永遠優先於其他兩項D. 三者不是嚴格的階層關係
看答案
答案:D。[35:49] Jason 說明 Asimov 故事最初是嚴格階層,並指出「in the spec we these three are are not in a a strict hierarchy」。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。