Claude Fable 5:在最前線工作


🏦 台灣Pay 銀行轉帳 💙 PayPal
多家企業客戶分享用 Fable 處理金融、程式、法律等複雜任務的成果
- 00:01 有一整類人們還沒想過的問題,現在因為 Fable 變得比較容易處理
- 01:34 Base 44 表示,這讓產品進入全新領域,打開以前不敢嘗試的新可能
- 02:34 Babel 在這類環境中「存活」的能力,比他們看過的任何模型都更進一步,大幅提升客戶把大型專案交給模型的信心
💡 你可以怎麼用:下次用 AI 時,可以試試把一件原本要花好幾天、步驟很多的工作整件交給它,例如整理一大疊資料寫成報告。只要把目標和要求講清楚,再看它能不能不靠你一路提醒就做完。
看全部 15 條重點
🧑🏫 這支影片是幾家企業客戶的現身說法:金融、寫程式、做 App、法律這幾個領域的公司,分享他們把很難的工作交給 Claude Fable 5 後得到什麼成果。值得看的地方在於,客戶描述的已經不只是「答得更準」,而是 AI 能不能獨立把一件又長又複雜的事做完。
- 00:01 有一整類人們還沒想過的問題,現在因為 Fable 變得比較容易處理↳ 有些事以前大家根本不會想交給 AI,因為太難、太長。現在模型變強,這些事突然做得到了,值得重新想想還有哪些工作可以交給它。
- 00:01 Hebia 是金融領域的人工智慧;在金融業,縮短 deal lifecycle 對公司的競爭力影響很大↳ Hebia 做的是金融業專用的 AI。deal lifecycle 指一筆交易從接洽、評估到成交的整段流程。誰能把這段時間縮短,誰就能比對手更快拿下生意。
- 00:01 Hebia 在他們非常完整的資料集上,看到大約 20% 的提升↳ 他們拿自己手上又大又完整的真實資料去測,換成 Fable 之後,表現大約好了兩成。這是這家公司自己測出來的結果,不是通用的評分。
- 00:31 Hebia 表示,資料集這麼複雜,更能看出模型的強項;使用者丟給它越來越複雜的問題,它還是能回出正確答案,讓使用者繼續挑戰自己能力的極限↳ 簡單的題目哪個模型都答得出來,題目越難才看得出差距。使用者一路把問題加深,模型還是答得對,所以大家敢繼續往更難的方向問。
- 00:31 Cursor 是用來開發專業軟體的 coding agent;以前得一直推著模型走,用 Fable 則能自己保持在正軌上↳ coding agent 是能自己讀程式、改程式、測試的 AI 助手。以前模型做到一半常常跑偏,要人一直提醒;Fable 比較能自己照著方向把事做完。
- 00:31 Cursor 表示,除了說「go and do it」之外什麼都不用講,就能做出真正深入的問題解決,這樣的模型他們沒見過↳ 重點是「交代一句就能放手」:不用拆步驟、不用一直盯進度,它就能深入找出問題的根源並解決。對 Cursor 來說,這是以前沒看過的程度。
- 01:02 Base 44 是高品質平台,讓任何使用者都能做出功能完整的應用程式↳ Base 44 讓不會寫程式的人也能做出真正可以用的 App,而不只是做出一個只有畫面、不能實際運作的樣品。
- 01:02 重建他們的 system prompt 原本需要公司前三名工程師花好幾天;用 Fable 連續跑了 4 小時,成果達到需求的 90-95%↳ system prompt 是事先給 AI 的一整套工作規則,使用者看不到。這份規則原本要公司最強的三位工程師花好幾天重寫,Fable 自己連續跑 4 小時就完成九成以上。
- 01:34 Base 44 表示,這讓產品進入全新領域,打開以前不敢嘗試的新可能↳ 以前因為太費工、風險太高而不敢做的功能,現在可以試試看了,產品能做到的範圍也跟著變大。
- 01:34 Thompson Reuters 歷史悠久,現在是科技公司,專注在需要專家資訊和持續溝通的專業領域↳ Thompson Reuters 是歷史悠久的新聞與資訊公司,現在把自己定位成科技公司,服務法律這類需要專業知識、又要跟客戶反覆溝通的行業。
- 01:34 法律上的 motion 是律師能提出的最複雜文件之一,要花好幾天到好幾週才能完成↳ motion 是律師向法院提出、請法官做出某個決定的正式書狀。寫的時候要引用法條和判例、整理事實,所以一份常要花好幾天到好幾週。
- 02:04 這類任務一直需要太多 context 和精確度,過去做不到;他們在 Claude 身上看到不錯的潛力↳ context 指 AI 做事時要一起讀進去的背景資料,例如案件卷宗、相關法條。寫 motion 要讀進大量資料,而且一點都不能出錯,以前 AI 做不到,現在開始有希望。
- 02:04 Thompson Reuters 表示,隨著模型進步,他們能做出的法律解決方案品質有真正的累積效果↳ 「累積效果」的意思是:模型每進步一次,他們的法律產品就跟著升級一次,好處一層一層疊上去,不是只好一次就停了。
- 02:04 Cognition 打造了 Deon,稱為世界第一個 AI 軟體開發者;他們有大客戶(例如擁有約 30,000 名工程師的銀行)有幾十年的內部工具,模型很難處理↳ Cognition 做的 Deon 是能自己接任務、寫程式的 AI 工程師。大銀行裡有用了幾十年、只在公司內部使用的老系統,AI 很難看懂。
- 02:34 Babel 在這類環境中「存活」的能力,比他們看過的任何模型都更進一步,大幅提升客戶把大型專案交給模型的信心↳ 「存活」是指在這種又老又雜的系統裡不迷路、不把東西弄壞,還能把事情做完。字幕這裡寫 Babel,看上下文應該是指這個新模型。它表現越穩,客戶就越敢把大案子交給它。
📘 術語
deal lifecycle(交易生命週期):字幕沒有解釋,只說在金融業縮短它對公司競爭力影響很大
coding agent(程式開發代理):字幕說 Cursor 是用來開發專業軟體的 coding agent
system prompt(系統提示詞):字幕沒有解釋,只說 Base 44 重建它要前三名工程師花好幾天
motion((法律)動議/聲請):字幕說它是律師能提出的最複雜文件之一,要花好幾天到好幾週完成
context(脈絡資訊):字幕沒有解釋,只說撰寫 motion 需要太多 context 和精確度
coding agent(程式開發代理):字幕說 Cursor 是用來開發專業軟體的 coding agent
system prompt(系統提示詞):字幕沒有解釋,只說 Base 44 重建它要前三名工程師花好幾天
motion((法律)動議/聲請):字幕說它是律師能提出的最複雜文件之一,要花好幾天到好幾週完成
context(脈絡資訊):字幕沒有解釋,只說撰寫 motion 需要太多 context 和精確度
✏️ 小考一題
根據影片,Base 44 用 Fable 重建 system prompt 時,連續跑了多久?結果達成多少?
A. 4 小時,達成需求的 20%B. 2 小時,達成需求的 100%C. 好幾天,達成需求的 90-95%D. 4 小時,達成需求的 90-95%看答案
答案:D。[01:02] 字幕:With Fable, everything worked for 4 hours, and the result was 90-95% of what we needed.
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰