深度分析 EVOM:以 LLM 為設計代理的元演化框架自動探索 Actor‑Critic 架構 在深度強化學習中,傳統演員-評論家網路多依賴手工設計,EVOM利用LLM作為設計代理,透過雙層優化將架構程式演化,並以低階PPO評估快速篩選,最終在Ant-v4與HalfCheetah-v4上超越手工基線與隨機搜尋,展示元演化與語言模型結合的效能。