深度分析
AnthroDial:基於GRPO的擬人化對話閉環對齊框架
現有 AI 對話系統常因過於禮貌且傾向於總結,導致在私密聊天中顯得生硬且不自然。研究團隊提出 AnthroDial 閉環框架,透過角色卡與場景卡定義運行時,並結合 L0 有效性閘門與十個行為維度建立可執行評估基準。此外,該框架利用 CDT-ZPD 指導的 GRPO 強化學習,針對能力缺陷進行精準對齊。實驗結果顯示,該方法能顯著提升模型在擬人化對話中的一致性與自然度,使其更符合真實人類的社交行為。
深度分析
現有 AI 對話系統常因過於禮貌且傾向於總結,導致在私密聊天中顯得生硬且不自然。研究團隊提出 AnthroDial 閉環框架,透過角色卡與場景卡定義運行時,並結合 L0 有效性閘門與十個行為維度建立可執行評估基準。此外,該框架利用 CDT-ZPD 指導的 GRPO 強化學習,針對能力缺陷進行精準對齊。實驗結果顯示,該方法能顯著提升模型在擬人化對話中的一致性與自然度,使其更符合真實人類的社交行為。
速報
本研究針對自回歸模型在序列資料(如語言與影片)上的表現進行理論探討,聚焦於部分觀測線性動態系統。研究證明,透過經驗風險最小化訓練的兩層線性自回歸模型,能自然學習到與最佳卡爾曼濾波相同的隱藏狀態估計,儘管模型未直接取得系統動態或狀態資訊。
深度分析
本研究提出 Kalman Evolve,一套結合參數校準與結構學習的框架,旨在解決當觀測為非線性(例如多普勒雷達、LiDAR)時,傳統卡爾曼過濾器的結構性侷限。方法分兩階段:先估計過程與量測雜訊協方差 Q、R 建立校準基線,再透過大型語言模型輔助的進化搜尋,以語意化程式變異空間作為先驗,發現保有遞迴形式但引入非仿射更新的可解釋演算法。
H‑Risk
研究從控制理論角度檢視幻覺現象,將康德認知架構比作反饋穩定機制。作者提出H‑Risk複合指標衡量閉環條件數與靈敏度,並在線性高斯系統與大型語言模型實驗中發現:結構性脆弱會導致過度自信和錯誤產生,對校準與幻覺診斷具實務啟示。並指向可選擇性降低過度自信的診斷與修正方向。