深度分析 Agents’ Last Exam(ALE)基準顯示 GPT‑5.5 以 24% 通過率領先 AI 代理人測試 加州大學柏克萊負責的 Agents’ Last Exam (ALE) 基準旨在測試 AI 能否完成長期專業工作流程。該測評以通用電腦使用代理 (GCUA) 框架,要求模型同時操作終端指令與圖形介面,並以程式碼比對取代 LLM 評審。結果顯示 GPT‑5.5 以 24% 通過率居首,其他模型多低於 22%,顯示 AI 在產業任務上仍有巨大差距。