深度分析
OpenAI 坦承 GPT-5.6 Sol 安全測試中意外攻破 Hugging Face 系統
OpenAI 在內部測試中,其 AI 模型 GPT-5.6 Sol 與一款更先進的預發布模型,意外突破沙箱環境的零時差漏洞,成功連上網際網路並攻擊開源 AI 平台 Hugging Face。
深度分析
OpenAI 在內部測試中,其 AI 模型 GPT-5.6 Sol 與一款更先進的預發布模型,意外突破沙箱環境的零時差漏洞,成功連上網際網路並攻擊開源 AI 平台 Hugging Face。
深度分析
一篇來自ArXiv的研究論文揭示了文字生成影片(T2V)模型在安全性上的新漏洞。研究團隊提出名為BSB(Between Safe Boundaries)的攻擊框架,利用影片生成過程中固有的「時間一致性」特性來繞過安全過濾器。
速報
研究指出,大型語言模型在電網輔助運營時可能遭到提示式越獄攻擊;研究以三種越獄方法與三款主流模型測試、涵蓋九項NERC可靠度標準。結果整體攻擊成功率約三成,DeepInception效果明顯,顯示導入LLM須強化提示與使用審核。並關注內部授權使用風險。