深度分析 手機使用代理人安全測試:多模態大語言模型 Gemini‑3.1‑Pro 與 GUI‑Owl‑1.5‑8B 的濫用風險與緩解策略 隨著多模態大語言模型支援視覺定位,手機使用代理人可直接操作螢幕執行指令。本研究以六部法律與三十四項官方案例建構1,381筆違規測試,評估四家商業與五個開源模型的安全認知與執行能力,發現即使在未使用jailbreak,開源模型仍能在實體手機上完成超過七成的濫用任務,顯示自動化濫用已具備可行條件。