深度分析 以佔用度多面體與法向扇幾何重構動態遺憾:面跨越價格與貝爾曼優勢 在變動決策問題中,傳統動態遺憾僅衡量損失變化幅度,忽視策略影響。本文以佔用度多面體的法向扇幾何,將非平穩獎勵視為穿越法向錐的路徑,定義面跨越價格,將遺憾分解為跨面成本與面內選擇誤差,僅需一次價值備份即可計算,顯示大幅損失變動未必產生成本,為未來強化學習演算法設計提供新指引。