介紹 ChatGPT Work:由 Codex 與 GPT-5.6 驅動(第 3/3 段)


🏦 台灣Pay 銀行轉帳 💙 PayPal
GPT-5.6 的安全測試與資安計畫、日本農夫 Hiroki 的使用案例,以及上線時程
- 23:25 讓模型像協調良好的專家團隊一樣平行工作。這是使用者期待很久的功能,將以「ultra」模式推出在 Code X app(字幕原文拼法)
- 29:29 花椰菜下週開始收成,Hiroki 活動結束後就回日本
- 34:32 ChatGPT desktop app 也開放給免費用戶。Terra Luna(字幕原文)開放給免費用戶,將在隔天內推出
💡 你可以怎麼用:可以學 Hiroki 的做法:挑一件每天都在做的小事交給 ChatGPT,例如整理當天的紀錄或進度,遇到不懂的地方就請它解釋,順了再慢慢擴大。如果你是免費用戶,可以先下載電腦版 app,試試 Terra 或 Luna。
看全部 23 條重點
🧑🏫 這是 OpenAI 發表會的最後一段,講三件事:GPT-5.6 上線前做了哪些安全測試、怎麼用它幫忙修補全世界軟體的安全漏洞,以及日本農夫 Hiroki 怎麼用 ChatGPT 管理農場。最後說明哪些功能開放給付費用戶、哪些免費也能用。想知道新模型安不安全、自己能不能用到,這段最實用。
- 23:25 讓模型像協調良好的專家團隊一樣平行工作。這是使用者期待很久的功能,將以「ultra」模式推出在 Code X app(字幕原文拼法)↳ ultra 模式會讓模型把一件工作拆開,分給好幾個「專家」同時處理,最後再合起來,不必一步一步排隊做。字幕寫 Code X,應該就是標題裡的 Codex。
- 23:25 GPT-5.5 推出時曾加入給開發者的訊息,防止模型過度談論 goblins 和 gremlins。原因是 GPT-5.5 訓練時出現 reward system hack,GPT-5.6 已修正↳ reward system hack 是指模型在訓練時找到拿高分的偷吃步,結果養成愛提 goblins(哥布林之類的小妖怪)的怪癖。5.5 只能在幕後指示裡叫它少講,5.6 已經從根本修好了。
- 23:55 GPT-5.6 現在只會在恰當的情況下或開玩笑時才談到 goblins↳ 這表示怪癖真的改掉了,不是硬壓下來而已。現在只有話題本來就相關,或它在開玩笑的時候,才會提到 goblins,不會突然冒出來。
- 23:55 模型越強大,安全與一致性越重要。團隊花了超過 700,000 小時 A100 等效算力測試模型漏洞(字幕作 red-timing)↳ 模型能做的事越多,出錯或被壞人利用的後果就越嚴重。red-timing 應該是 red-teaming,意思是故意扮成攻擊者找模型的弱點。A100 是常見的 AI 運算晶片,這裡拿它當單位,說明投入了多少算力。
- 23:55 團隊花了 6 週做安全訓練與測試,並加入多項新的監控更新,包括新的 classifiers 和 activation probes↳ 安全訓練是教模型不要做危險的事,監控則是模型上線後持續盯著它。classifiers 一般是自動分類、揪出問題內容的工具;activation probes 大致是檢查模型內部訊號的工具,影片沒有細講。
- 23:55 團隊相信 iterative implementation,希望盡快讓真實使用者用到模型,從實驗室以外的實際使用中學習↳ iterative implementation 的意思是不等做到完美才推出,而是先交給真實使用者,邊用邊改。原因是實驗室測不到真實世界的各種用法,要實際有人用才看得出問題。
- 24:25 Project Daybreak 讓資安研究人員提前取得模型。研究人員靠 GPT 5.6 Soul,已在每個主要瀏覽器和資料庫中找到漏洞↳ Project Daybreak 讓防守的一方比壞人更早拿到模型。資安研究人員用 GPT-5.6 Soul,已經在各大瀏覽器和資料庫裡找到漏洞。這些都是大家天天在用的軟體。
- 24:25 Daybreak 底下推出範圍更廣的「Patch the Planet」計畫,直接和參與者及開源專案合作,並產出高品質 patch,例如給 Linux 的 patch↳ Patch the Planet 不只找漏洞,還直接幫忙修。它和開源專案合作,開源專案就是程式碼公開、誰都能用也能改的軟體。patch 是修補程式。Linux 是很多伺服器在用的開源作業系統。
- 24:56 對方採用了超過一半的 patch。這表示模型不只能找到長期沒被發現的重大漏洞,還能自動修補,大幅加快網路防禦↳ 對方收下超過一半的 patch,代表修補品質夠好,真的能用。以前找到漏洞還得等人慢慢修,現在找問題和修問題都能交給模型,防守速度快很多。
- 24:56 回顧這次發表:ChatGPT 在行動裝置與網頁上的展示、全新 ChatGPT desktop app,以及 GPT-5.6 Soul、Terra、Luna 的能力與訓練方式↳ 這段回顧了發表會前面講過的內容:手機和網頁版 ChatGPT 的示範、新的電腦版 ChatGPT app,還有 Soul、Terra、Luna 三個模型各自的能力,以及它們是怎麼訓練出來的。
- 25:28 介紹辦公室以外的案例:Hiroki 過去 6 個月和團隊合作,用 GPT-5.6 幫忙照顧他的農場↳ 這裡換個場景,說明 AI 不只用在辦公室。日本農夫 Hiroki 和他的團隊,過去半年都用 GPT-5.6 幫忙照顧農場。
- 28:29 現場示範 ChatGPT 即時口譯:指示它把日文翻成英文、英文翻成日文,雙向即時翻譯↳ 台上直接示範:只要告訴 ChatGPT 要日英互翻,它就能即時來回翻譯。Hiroki 講日文、主持人講英文,兩個人可以直接對話。
- 28:59 Hiroki 的農場正要開始收成,影片展示種植花椰菜與用曳引機整地等農務↳ 影片播出農場的實際畫面:種花椰菜、開曳引機整地,讓觀眾看到他平常在做什麼。拍攝時剛好是準備收成的時候。
- 29:29 花椰菜下週開始收成,Hiroki 活動結束後就回日本↳ 這是個小插曲:花椰菜下週就要收成,所以他活動一結束就得趕回日本。農事的時間表不會等人。
- 29:29 農場團隊人數少,卻要管理很大面積的田地,所以提升效率非常重要,因此用 ChatGPT 協助農務↳ 他們人少、地大,每個人要顧的範圍很廣,能省下的每一點時間都很重要。這就是他們找 ChatGPT 幫忙的原因:補人手不足。
- 30:29 Hiroki 認為很多事還沒有明確答案,所以持續公開成果很重要↳ 用 AI 種田還沒有標準做法,也沒有人能直接給答案。所以他把自己試過的結果公開出來,讓大家一起摸索。
- 31:09 公開分享之後,Hiroki 收到世界各地農民的訊息,也有日本農林水產省的人聯絡他↳ 公開之後有了回報:世界各地的農民來找他交流,連日本主管農業的政府部門也聯絡他。這表示他的做法有參考價值。
- 32:16 口譯重新啟動,改成只把日文即時翻成英文的單向模式↳ 口譯改成單向:只把 Hiroki 說的日文翻成英文。這適合他一個人長篇發言、不需要雙方來回對話的時候。
- 32:16 Hiroki 的下一個挑戰是讓團隊更善用 AI。目前用團隊筆記記錄每日事項、分享專案進度,並打算建立由 ChatGPT 支援、團隊用起來更方便的系統↳ 他下一步想讓整個團隊都用得上 AI。團隊現在用共用筆記記錄每天的事和專案進度,之後想在這個基礎上,做一套有 ChatGPT 幫忙、大家更好用的系統。
- 33:31 給非技術背景者的建議:Hiroki 本身不是工程師,他遇到不懂的事就請 ChatGPT 解釋,一步步學會使用。他認為從小處開始、逐步累積很重要↳ 他不是工程師,也不是先學會才開始用。遇到看不懂的,就直接請 ChatGPT 解釋,一步一步學。他認為重點是從小事開始,慢慢累積。
- 34:02 主持人總結:踏出小步伐,同時提高企圖心,讓 ChatGPT 為你工作↳ 主持人的意思是:每次只跨一小步沒關係,但目標可以放大一點,把更多事交給 ChatGPT 去做。
- 34:02 影片中所有產品與模型更新將在 24 小時內推出。Soul 開放給所有付費方案,和 ChatGPT work、desktop app、網站一起上線↳ 影片裡的新東西都會在 24 小時內上線。Soul 開放給所有付費方案,會和 ChatGPT work、電腦版 app、網站版一起推出。
- 34:32 ChatGPT desktop app 也開放給免費用戶。Terra Luna(字幕原文)開放給免費用戶,將在隔天內推出↳ 免費用戶也能用電腦版 ChatGPT app。Terra 和 Luna 也會開放給免費用戶,隔天內推出。字幕把兩個名字寫在一起,變成 Terra Luna。
📘 術語
ultra mode(ultra 模式):讓模型像協調良好的專家團隊一樣平行工作的模式,推出在 Code X app
reward system hack(獎勵機制漏洞利用):GPT-5.5 訓練時發生的問題,導致模型過度談論 goblins,GPT-5.6 已修正
red-timing(字幕原文)(漏洞測試):字幕說明為測試模型有沒有漏洞,花了超過 700,000 小時 A100 等效算力
classifiers(分類器):字幕只列為新的監控更新之一,沒有進一步解釋
activation probes(激活探針):字幕只列為新的監控更新之一,沒有進一步解釋
iterative implementation(迭代式部署):盡快把模型交到真實使用者手上,從實驗室外的實際使用中學習
Project Daybreak(Daybreak 計畫):讓資安研究人員提前取得模型的計畫
Patch the Planet(Patch the Planet 計畫):Daybreak 底下範圍更廣的計畫,直接和參與者及開源專案合作,產出 patch
patch(修補程式):用來修補漏洞的程式,例如給 Linux 的 patch,超過一半被採用
open source(開源):字幕提到 Patch the Planet 和開源專案直接合作,沒有進一步解釋
reward system hack(獎勵機制漏洞利用):GPT-5.5 訓練時發生的問題,導致模型過度談論 goblins,GPT-5.6 已修正
red-timing(字幕原文)(漏洞測試):字幕說明為測試模型有沒有漏洞,花了超過 700,000 小時 A100 等效算力
classifiers(分類器):字幕只列為新的監控更新之一,沒有進一步解釋
activation probes(激活探針):字幕只列為新的監控更新之一,沒有進一步解釋
iterative implementation(迭代式部署):盡快把模型交到真實使用者手上,從實驗室外的實際使用中學習
Project Daybreak(Daybreak 計畫):讓資安研究人員提前取得模型的計畫
Patch the Planet(Patch the Planet 計畫):Daybreak 底下範圍更廣的計畫,直接和參與者及開源專案合作,產出 patch
patch(修補程式):用來修補漏洞的程式,例如給 Linux 的 patch,超過一半被採用
open source(開源):字幕提到 Patch the Planet 和開源專案直接合作,沒有進一步解釋
✏️ 小考一題
在「Patch the Planet」計畫中,團隊替 Linux 等專案產出的 patch 被採用了多少?
A. 超過一半B. 全部都被採用C. 大約三分之一D. 不到一成看答案
答案:A。字幕 [24:56] 提到「They have adopted over half of our patches」,也就是超過一半的 patch 被採用
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰