深度分析 ThinkDeception:結合強化學習與多模態大型語言模型的可解釋欺騙偵測框架 多模態欺騙偵測缺乏可解釋性。ThinkDeception 以多模態大型語言模型結合階梯式強化學習,建立 Deception-10K 逐步推理資料集,並提出 VAC‑GRPO 以捕捉視聽不一致。實驗證明其在準確度與推理品質上均領先於現有方法,為未來研究提供可解釋的認知框架。