AI 課本 › 🟢 客戶案例

介紹 GPT-5.5:與 Databricks 合作

2026/04/29 · 1 分鐘 · 官方字幕實證
Databricks 說明 GPT-5.5 在 agent harness 中的錯誤減少與文件解析品質提升
💡 你可以怎麼用:如果你常讓 AI 讀 PDF 報表或掃描檔再回答問題,可以把同一份文件分別交給新舊模型,逐一核對裡面的數字有沒有抓對,再決定要用哪一個。
看全部 10 條重點

🧑‍🏫 這支是 Databricks 分享 GPT-5.5 在他們平台上的實測結果。重點是 5.5 讀雜亂文件、抓數字的能力明顯變強,錯誤大幅減少。如果你常請 AI 處理報表或文件,看完會知道新模型到底強在哪裡。

📘 術語
agent harness(agent 執行框架):字幕未直接解釋;提到 multi-agent 架構可在 agent harness 內執行解析
benchmark(基準測試):字幕未直接解釋;提到 GPT 5.5 是唯一在該 benchmark 上超過 50% 的模型
Office QA(Office QA(測試名稱)):用來代表客戶在 Databricks 上的實際工作流程
parsing(解析):字幕提到要處理雜亂文件,並指出早期模型無法正確解析所有數字
multi-agent(多 agent):Databricks 使用的架構,可在 agent harness 內執行解析
Agent Bricks(Agent Bricks(產品名)):Databricks 的產品,用來建立自訂 agent 工作流程
Agent Supervisor API(Agent Supervisor API(產品名)):Databricks 的產品,用來建立自訂 agent 工作流程
supervisor(監督者):GPT 5.5 在自訂 agent 工作流程中擔任的角色
✏️ 小考一題

根據影片,在 agent harness 設定下,GPT 5.5 的錯誤比 5.4 減少了多少?

A. 56%B. 46%C. 40%D. 50%
看答案
答案:B。[00:02] 字幕說 GPT 5.5 在 agent harness 設定下的錯誤比 5.4 減少 46%。50% 是它在 benchmark 上超過的門檻,不是錯誤減少的幅度。
📺 看原片📚 在課本 App 讀
💛 覺得有幫助?支持一下台灣Pay 銀行轉帳 QRPayPal QR
課本免費、沒有廣告,支持與否都能照常讀 🐰

重點整理自 YouTube 影片字幕,每條附時間碼可跳回原片;🧑‍🏫/↳ 是 Claude 補充的白話,不是影片原話。