深度分析 DramaSR-LRM:利用大型推理模型破解長篇影集角色辨識挑戰 長篇影集因角色眾多且對話複雜,傳統語音辨識難以精準判定說話者。本研究推出 DramaSR-532K 大規模基準集,並開發基於大型推理模型的 DramaSR-LRM 框架,整合語音相似度、影像描述與角色關係資料庫,讓 AI 能透過多模態工具聚合證據進行推理。結果顯示該方法顯著提升了短對話辨識準確率,為長影片深度理解提供新路徑。