深度分析 LLVM‑Bench:LLM 驅動的 LLVM 編譯器問題解決平台與 LLVM‑Ens 整合方法 LLVM編譯器因規模龐大且複雜,問題修復成本高。研究推出LLVM‑Bench基準,收錄423筆真實LLVM問題,並建置LLVM‑Gym自動化平台。實驗顯示單一LLM解決率最高僅2.3%,結合多模型的LLVM‑Ens可提升至22%。主要失敗來自修補無法套用與編譯失敗。