深度分析 以自我條件化與 FlowDPO 優化的 Flow Reasoning Models 在 Sudoku 上達 99.8% 解題率 離散流模型在數獨、Zebra 等約束滿足問題上表現不佳,研究提出 Flow Reasoning Models(FRM),結合自我條件化(self‑conditioning)與固定點穩定性驗證,在測試時以大量候選解並篩選內部穩定解,使求解率從原本約 36% 提升至近 100%。