深度分析
MedCalc‑Pro:結合大型語言模型的醫學多工具與嵌套計算平台
隨著大型語言模型在醫學領域的應用深化,傳統計算基準僅支援單一工具且需明示目標計算器。研究團隊推出MedCalc‑Pro,收錄2268例、77種計算器,涵蓋單、多人與嵌套計算情境,並建構多工具選擇與依賴關係的代理框架。實驗顯示該框架在所有測試任務上均優於現有方法。
深度分析
隨著大型語言模型在醫學領域的應用深化,傳統計算基準僅支援單一工具且需明示目標計算器。研究團隊推出MedCalc‑Pro,收錄2268例、77種計算器,涵蓋單、多人與嵌套計算情境,並建構多工具選擇與依賴關係的代理框架。實驗顯示該框架在所有測試任務上均優於現有方法。
大型語言模型
大型語言模型在醫學考試題目上表現亮眼,研究者以認知醫學推理理論將醫療推理劃分為演繹、溯因與歸納三階段,並整理出七條技術路徑。新推出的 MR-Bench 基於真實醫院資料,測試結果顯示模型在臨床決策上的準確度仍有明顯差距。