深度分析 新研究揭露AI科學寫作驗證器漏洞,分割共形預測提供有限樣本保證 AI 科學文獻合成代理系統的引用驗證機制存在重大不一致性。研究發現同一輸出在不同驗證器下無支援引用率從約 3% 到 18% 不等,且驗證器間對須標記案例共識極低。團隊提出以人類黃金標準為錨點的評估協議與基於分割共形預測的防護機制,能對未標記的無支援引用提供有限樣本保證。