深度分析 AI 護欄雙面刃:防禦研究員遭擋,開源模型成替代方案 AI 巨頭如 Anthropic 和 OpenAI 為防止模型被惡意駭客濫用,設立了嚴格的護欄與審核計畫。然而,這些限制正嚴重阻礙合法網路防禦與攻擊性安全研究員的工作。研究員指出,AI 模型無法區分「修復程式碼」與「攻擊程式碼」,導致防禦任務也被拒絕。