深度分析 SPADER:步驟同儕優勢與多樣性探索獎勵提升多答案問答的召回與 F1 表現 隨著大型語言模型被廣泛用於工具增強型代理人,研究聚焦於單一答案的長程推理。本文提出SPADER框架,結合步驟同儕優勢機制與多樣性探索獎勵,提升多答案問答的覆蓋率。實驗顯示在四大基準上召回與F1均優於現有方法。此技術有望提升搜尋助理與知識圖譜建構的完整性,並推動開發者設計更具探索性的AI代理人。