深度分析
SkillForge:自演化雲端技術支援領域智慧代理人技能鍛造框架
在雲端技術支援領域,SkillForge 以領域知識庫和歷史票據為基礎生成技能,並透過失敗分析、技能診斷與優化三階段自動迭代。實驗證明此自演化循環可持續提升技能品質,甚至超越手工專家。
深度分析
在雲端技術支援領域,SkillForge 以領域知識庫和歷史票據為基礎生成技能,並透過失敗分析、技能診斷與優化三階段自動迭代。實驗證明此自演化循環可持續提升技能品質,甚至超越手工專家。
大型語言模型
研究針對大型語言模型在航空安全領域的推理能力提出基準。PilotBench 以 708 筆真實飛行軌跡與 34 通道遙測,衡量模型在六至九大飛行階段的預測與安全合規。結果顯示傳統預測器精度較高,LLM 在指令遵循上表現佳,但在高負荷階段精度下降,突顯混合架構的需求。