深度分析 以 DRIFT-Bench 分解矛盾與可滿足漂移:MUS-Repair 對多回合約束推理的修復評估 研究檢視多回合約束推理失敗模式,指出系統常保持內部一致卻回應違反先前承諾。作者提出DRIFT-Bench與MUS-Repair,結合解算器在每回合檢驗分類、以最小不可滿足子集回饋修復並重試答案。實驗顯示修復後殘餘錯誤近乎完全為可滿足漂移,矛盾性幾乎降為零,意義在於須建立第二道驗證以檢查回應是否尊重已維持狀態。