速報 大型語言模型自主滲透測試框架揭示成功率最高達 69.3% 近期研究針對前沿人工智慧系統的紅線之一——自主執行可能造成實際危害的網路攻擊,提出全新自主滲透評估框架。該框架以兩層目標伺服器環境(Tier‑1、Tier‑2)共 300 台機器,結合一般化的代理架構與多元資安工具,測試 19 種開放與商業化大型語言模型的滲透能力。