Abridge 如何使用 GPT-5.5 做臨床決策支援


🏦 台灣Pay 銀行轉帳 💙 PayPal
Abridge 用 GPT-5.5 強化臨床決策支援,工具變多時表現反而更好
- 00:02 使用 GPT-5.5 時,工具數量越多,Abridge 在評估集上的結果反而呈上升趨勢。
- 00:34 採用 GPT-5.5 後,團隊看到更高、更好的臨床推理(clinical reasoning)與工具使用(tool use)表現。
- 01:04 團隊在結果上看到非常明顯的躍升,也很興奮能與 OpenAI 合作。
💡 你可以怎麼用:如果你的 AI 工具接了很多外掛或資料,可以準備幾題你已經知道答案的問題,當成自己的小評估集,比較加工具前後答得對不對。遇到健康這類重大決定時,就把 AI 當成整理資料的助手,最後的決定還是交給自己或專業人士。
看全部 10 條重點
🧑🏫 Abridge 是做醫療 AI 的公司。這支影片由他們的工程負責人說明:換成 GPT-5.5 後,醫生看診時的輔助系統變得更準、更精簡,而且接上的工具越多,表現反而越好。一般的經驗是,給 AI 的東西越多,它越容易亂掉。這支影片的結果和這個經驗相反,所以值得一看。
- 00:02 使用 GPT-5.5 時,工具數量越多,Abridge 在評估集上的結果反而呈上升趨勢。↳ Tool use(工具使用)是指 AI 去呼叫外部功能,例如查資料庫。一般以為工具越多越容易選錯。Abridge 用一組固定考題(evaluation set,評估集)來測,結果工具越多,分數反而越高。
- 00:02 團隊認為這個上升趨勢清楚顯示,這個模型更能綜合整理資訊。↳ 工具變多,代表進來的資料又多又雜。分數還能往上走,表示模型不只會把資料拿回來,還能把不同來源的內容整合成有用的結論,不會越餵越亂。
- 00:02 講者 Chaitanya 是 Abridge 臨床決策支援(clinical decision support)的工程負責人。↳ Clinical decision support(臨床決策支援)是在醫生看診、做判斷時,提供資訊和建議的系統。Chaitanya 負責的是把這套系統做出來的工程團隊。
- 00:02 他們的目標是運用全世界的醫學資訊,加上醫病即時對話中的所有病患脈絡,協助臨床醫師做決策。↳ 他們要把兩種資料放在一起用。一種是全世界通用的醫學知識,另一種是這次看診時病人當下講的狀況。兩者對起來,給出的建議才會貼合眼前這位病人。
- 00:34 採用 GPT-5.5 後,團隊看到更高、更好的臨床推理(clinical reasoning)與工具使用(tool use)表現。↳ Clinical reasoning(臨床推理)是從症狀一步步推到可能病因和處置的思考過程。換成 GPT-5.5 後,這種推理能力,以及挑對工具、用對工具的能力,都進步了。
- 00:34 講者表示,現在的資訊密度(information density)好很多。↳ Information density(資訊密度)是指同樣的篇幅裡有多少真正有用的內容。現在模型給的東西更精實,廢話少、重點多,醫生用同樣的時間能讀到更多。
- 00:34 醫學很複雜,所以他們要把高資訊密度直接帶到照護現場(point of care),最終決定仍由臨床醫師來做。↳ Point of care(照護現場)就是醫生面對病人、正在看診的當下。現場時間很少,所以資訊要濃縮又即時。AI 只負責遞上資料,判斷和拍板還是醫生的事。
- 00:34 講者最興奮的一點:他們相信持續加入工具和脈絡時,模型也能跟上隨之增加的複雜度。↳ 產品會一直擴充,工具和資料只會越加越多。他們最看好的是,模型不會因此被壓垮,複雜度上升時表現也跟得上,產品才有辦法繼續長大。
- 00:34 因此模型能為使用者帶來更多價值,並達到這類產品所要求、也必須具備的嚴謹程度。↳ 醫療出錯的代價很高,這類產品對正確性的要求比一般 AI 應用嚴格得多。模型撐得住複雜度,才能一邊加功能幫醫生,一邊守住這個標準。
- 01:04 團隊在結果上看到非常明顯的躍升,也很興奮能與 OpenAI 合作。↳ 換模型後,評估結果是明顯跳了一階,不只是小幅改善。最後這句是團隊對這次成果,以及和 OpenAI 合作的正面表態。
📘 術語
clinical decision support(臨床決策支援):運用世界醫學資訊與醫病即時對話中的病患脈絡,協助臨床醫師做決策。
evaluation set(評估集):團隊用來衡量模型表現的資料集,工具變多時結果呈上升趨勢。
tool use(工具使用):字幕提到 GPT-5.5 在工具使用上表現更好,工具數量增加時結果也更好。
clinical reasoning(臨床推理):字幕提到使用 GPT-5.5 後,看到更高、更好的臨床推理表現。
information density(資訊密度):字幕說現在資訊密度好很多,並要把它帶到照護現場給臨床醫師。
point of care(照護現場):要把資訊帶到的地方,由臨床醫師在此做最終決定。
evaluation set(評估集):團隊用來衡量模型表現的資料集,工具變多時結果呈上升趨勢。
tool use(工具使用):字幕提到 GPT-5.5 在工具使用上表現更好,工具數量增加時結果也更好。
clinical reasoning(臨床推理):字幕提到使用 GPT-5.5 後,看到更高、更好的臨床推理表現。
information density(資訊密度):字幕說現在資訊密度好很多,並要把它帶到照護現場給臨床醫師。
point of care(照護現場):要把資訊帶到的地方,由臨床醫師在此做最終決定。
✏️ 小考一題
根據 Abridge 的說法,使用 GPT-5.5 時增加工具數量,評估集上的結果出現什麼變化?
A. 結果呈下降趨勢B. 結果大致持平沒有變化C. 結果變得不穩定,需要減少工具D. 結果呈上升趨勢看答案
答案:D。[00:02] 講者說使用 GPT-5.5 時,隨著工具數量增加,在評估集上看到上升趨勢(upward trend)。
💛 覺得有幫助?支持一下


課本免費、沒有廣告,支持與否都能照常讀 🐰