速報
AI 對齊新思路:以客觀底線取代單一人類價值觀
本研究批判了將人工智慧對齊至單一、聚合的人類偏好之做法,指出不同社會與政治立場會產生截然不同的價值觀,若以此為唯一指令可能導致危險。作者主張 AI 應以不可協商的客觀底線為基礎,包括能力、事實正確性、誠實與合法性,並將多元價值限制於表層語言與合理的價值取捨。
速報
本研究批判了將人工智慧對齊至單一、聚合的人類偏好之做法,指出不同社會與政治立場會產生截然不同的價值觀,若以此為唯一指令可能導致危險。作者主張 AI 應以不可協商的客觀底線為基礎,包括能力、事實正確性、誠實與合法性,並將多元價值限制於表層語言與合理的價值取捨。
速報
本研究挑戰以單一人類價值觀對齊人工智慧的傳統觀點,指出不同社會與政治立場會導致截然不同的價值取向,若以此為唯一目標可能帶來風險。作者主張,AI 應先遵守不可協商的客觀底線——包括能力、事實正確性、誠實與合法性——再在語言、語調與合法價值交換層面容納多元觀點。