深度分析 彎曲指導結合模組定位與低秩修復:快速除毒大型語言模型後門的新方法 隨著大型語言模型普及,後門攻擊成為重大威脅。研究提出彎曲指導的模組定位結合低階矩陣修復,只針對關鍵模組去除觸發行為,實驗在Llama‑3.2‑1B‑Instruct上大幅抑制惡意回應且保留正常功能。方法以激活貼補與Fisher/K‑FAC曲率定位高影響模組,再以低秩適配器修復,較CROW表現更佳,預示未來能快速除毒而不損效能。