深度分析 Theoria:以狀態重寫驗證非正式推理的可審核框架 研究背景:人工智慧回應可信度成關鍵。核心技術:Theoria將答案重寫為帶類型證明步驟的狀態序列,並以完整變更不變式檢測隱藏前提與偽造引用。主要結果:在HLE‑Verified Gold測試中達到91.4%嚴格精準率,且對抗性測試比傳統LLM評分提升近12個百分點。