速報 簡易提示提升大型語言模型與人類道德判斷對齊 研究檢視大型語言模型(LLM)在捕捉人類道德判斷時的兩大缺陷:回應分布不完整與表述變化導致判斷不穩定。透過兩套資料集——美國 144 個道德情境與國際社會調查計畫 32 國的 38 項道德信念——實驗證明,讓模型同時回報標準差與回應比例,可更完整呈現人類回應範圍;