深度分析 「PolicyShiftGuard」:雙階段訓練模型實現政策適應影像安全防護 隨著不同產品與地區的內容政策變動,傳統影像安全防護難以因應。研究推出PolicyShiftBench與PolicyShiftGuard,前者提供2,000筆政策變化測試,後者結合隨機政策SFT與邊界配對適應,使模型在政策轉換下F1達76.9、PSS達72.1,顯示政策感知大幅提升安全判斷彈性。