跳到主要內容

發表文章

精選

KARE:以知識圖譜社群檢索與推理蒸餾提升醫療預測

先把 KARE 想成一張新竹地圖。清大、Costco、光復路和竹科是地點,道路把它們連起來;在醫學地圖裡,地點就是疾病、藥物和治療,道路就是它們的關係。彼此靠近、常一起出現的地點會形成生活圈,也就是文中的小組。例如清大、宿舍和校車像學生小組;竹科、Costco 和通勤道路像工程師小組。小組不是住宅社區,而是一包能共同解釋情況的知識。更重要的是,同樣都去光復路,從清大附近出發的人較可能是學生,從 Costco 附近出發的人較可能是竹科工程師。終點一樣,出發點和周圍線索不同,判斷就不同。KARE 看病人也是這樣:它不是只看一個疾病名稱,而是看病人從哪些疾病、用藥和住院紀錄出發,再從大地圖挑出最能解釋這名病人的幾個小組,用來預測死亡或 15 天內再入院。 整個方法可以想成三步。第一步先畫一張不會太大的醫學地圖。系統看整批病歷,找出哪些疾病和藥物常一起出現;這些資料像手電筒,決定照亮醫學世界的哪些角落。再從資料庫、論文和大模型補上道路,例如心衰竭怎麼連到腎功能和利尿劑。這就是前面提到的 anchor,只是方便理解的說法。地圖建好後,系統把連線密集的知識分組,先替每組寫懶人包。第二步是病人進來後挑會診小組。先選最符合病歷的一組,接著降低相同內容的分數,再找下一組。因此心臟資訊夠了,就改叫腎臟或藥物安全小組。第三步像老師帶學生。較強的模型先看病歷、知識和正確答案,寫出解題示範,再教較小的模型;新病人來時,小模型仍要自己判斷。 研究用兩套重症病歷測試死亡與再入院預測。因為真正死亡的病人較少,只看整體答對率很容易被騙,所以論文也看 Macro-F1 和 Sensitivity。前者像同時替高風險與低風險兩班學生算平均,後者則看真正高風險的人有多少被抓到。在 MIMIC-IV 的死亡預測中,KARE 的答對率是 94.1%,兩班平均分數是 90.4%,高風險病人找回率是 73.2%。在較難的 MIMIC-III 中,原方法只找到 17.2% 的高風險病人,KARE 提升到 24.7%。拆解結果也顯示,先看病人真正有的問題、避免反覆拿相同知識最重要。不過它仍只是輔助工具,因為資料來自單一醫院,醫學地圖和模型都可能出錯。 圖1:像一條三站生產線。左上第一站先蒐集醫學資料、整理同義名稱,再把知識分成許多會診小組並寫好摘要。左下第二站才處理個別病人,依病歷挑出最有用、又不重複的幾組知識。右側...

最新文章

如何讓神經網路不只是算出答案,而是能穩定地往目標狀態前進?

果蠅不只是追著氣味走:一種基於方向記憶的導航策略

「模型鑽牛角尖時也需要緩緩。越深,越需要學會忘記 」。類腦運算的解析 - Dropout 如何穩定深層回聲狀態網路(Deep ESN)

我們的腦神細胞比較聰明?從樹突與NMDA看神經元的計算複雜度

單目 VIO 的尺度問題:從運動軌跡看尺度可觀測性與估計器一致性

果蠅行走行為的多層次控制

Hippocampal Theta Sweeps:海馬迴如何指向導航目標?

閉著眼睛,你怎麼知道自己的手在哪裡?讓 5600 個神經網路參加大逃殺,替大腦的「身體感」選出了標準答案

我們真的需要連續編碼嗎?

Izhikevich Neurons, Part 5: Post-inhibitory rebound