深度分析 AET 框架與 AETDICE 演算法:離線非線性多目標強化學習的統一解法 多目標強化學習面臨非線性偏好挑戰,研究提出AET框架統一SER與ESR並開發離線算法AETDICE,成功在靜態資料集上優化多種非線性目標,展示出策略差異與未來應用潛力。此方法利用DICE式密度比估計在增廣狀態空間中進行樣本優化,突破以往無法同時處理兩層非線性之限制,為未來公平與風險敏感的AI決策提供新工具。