深度分析 視覺語言模型在非對稱對話中過度預測共識的偏誤:以 Qwen3‑VL 與 Gemma3 為例 本研究以HCRCMapTask對話資料檢測視覺語言模型在資訊不對稱情境下判斷參與者是否已達成共同理解。結果顯示,提供真實地圖圖像或文字說明會使模型過度預測對齊,將潛在的參照重疊誤當成已建立的共識;而非資訊性圖像則降低此偏誤。此偏誤可能限制模型在真實協作對話中的可靠性。