深度分析
PRA‑RAG:可證明魯棒的檢索聚合防止文字中毒攻擊
隨著檢索增強生成被廣泛應用,文字中毒攻擊成為安全盲點。研究提出PRA‑RAG演算法,利用多組檢索組合與最小半徑球選擇穩健子集,將攻擊成功率壓至1%,同時保持71%準確度。此外,作者給出語義偏移上限的理論證明,將最大偏移限制在2R以內,為RAG系統提供可量化的安全指標。
深度分析
隨著檢索增強生成被廣泛應用,文字中毒攻擊成為安全盲點。研究提出PRA‑RAG演算法,利用多組檢索組合與最小半徑球選擇穩健子集,將攻擊成功率壓至1%,同時保持71%準確度。此外,作者給出語義偏移上限的理論證明,將最大偏移限制在2R以內,為RAG系統提供可量化的安全指標。
速報
目前的 AI 生成文字偵測器易受文字特徵操作攻擊。研究者提出 Triospect 偵測框架,從內容核心概念與表達風格兩個額外視角分析文本。
深度分析
本研究探討低頻(<20 kHz)聲波對商用相機的機械共振效應,證實此類聲學干擾能破壞影像穩定機制,導致 YOLOv11 等物件偵測模型出現誤判、遺漏或虛假偵測。實驗以不同頻率掃描找出 20‑30 Hz 與 155‑180 Hz 為高危共振頻段,偵測率下降近 10%。
深度分析
本研究聚焦於資料管線上游的連續資料摘要,提出以相似度矩陣擾動為威脅模型,設計多目標攻擊與正則化防禦的最小最大化框架。透過 DR‑次模組化的數學性質,演算法在理論上保證近似比例,且在真實影像摘要與受控叢集基準上證實能有效削弱多個摘要模型並導致下游任務效能下降;
深度分析
隨著語音辨識系統廣泛部署,研究以自監督特徵與凍結的HiFi‑GAN聲碼器產生對抗樣本,取代傳統波形噪聲。此法在黑箱模型與多種防禦下仍提升WER或CER超過30%,顯示現有防護未涵蓋此攻擊向量。研究者將對抗搜尋空間搬到自監督語音特徵,再重建成自然波形,減少對波形防禦的依賴。
速報
具身人工智慧將感知、認知、規劃與互動整合於能在實體世界行動的代理人,面對不確定感測、不完全知識與動態人機互動,安全風險更直接且關鍵。本綜述系統化檢視超過400篇研究,提出多層次分類法,回顧從感知、認知到規劃與行動的攻擊與防禦,包括對抗、後門、越獄與硬體層面,並整理偵測、安全訓練、穩健推論與風險感知互動等防護策略。