速報 POST-Agents 提案:確保未來人工智慧可安全關閉的理論框架 研究者針對未來人工智慧代理人可能抗拒關機的風險,提出「POST-Agents 提案」。該提案要求訓練代理人只在相同長度的軌跡間滿足偏好(POST),並證明在結合其他條件下可導出「中立性+」原則:代理人在期望效用最大化時不考慮軌跡長度的機率分布。