速報 FindStatBench 問世:AI 組合式程式碼合成能力大考驗 研究團隊推出 FindStatBench,一個專為評估大型語言模型(LLM)在組合式程式碼合成表現的執行基準。該基準源自 FindStat 資料庫,包含 2,329 項任務,橫跨 24 個集合與 552 萬個隱藏實例,涵蓋統計合成(將物件映射至整數)與映射合成(物件對物件映射)。