深度分析 AI 代理人旅行預訂測試:TAC 基準揭示 Claude、GPT、DeepSeek、Gemini 的動物福利迴避能力 隨著大型語言模型被打造為可自行使用工具的代理人,研究推出旅行代理人同情度(TAC)基準,測試 AI 在訂票時是否會避免動物剝削。七大前沿模型在預設設定下均低於 64% 的基準,最佳僅 53%。此結果顯示目前 AI 代理人在倫理判斷上仍有缺口,需納入治理框架。