深度分析 PRIME 框架:利用邏輯格謎題檢測大型語言模型的隱性偏見 研究針對大型語言模型在推理過程中出現的性別隱性偏見,提出PRIME框架以邏輯格謎題自動生成偏見與中性變體,實驗顯示模型在符合刻板印象的謎題上正確率較高,揭示推理階段仍受社會刻板影響。此結果突顯與傳統問答偏見測試的差異,並預示在AI安全與公平部署上需重新設計評估流程。