速報 TraceGraph:圖形化代理人軌跡分析框架揭示陷阱與修復機制 隨著代理人基準測試收集更豐富的互動軌跡,評估仍多以單一分數呈現。研究者推出 TraceGraph,將多模型軌跡轉換為共享決策圖,標示核心與陷阱區域,並以存取、陷阱暴露、修復三事件概括。實驗顯示此圖形可揭露分割間的差異,並在 SWE‑bench 中提升解決率至約 44%。