arXiv · Computer Vision· Binchi Zhang, Atrisha Sarkar, Apurva Narayan·· 8 hr agoSelectedAI score65
视觉-语言模型 targeted semantic substitution 攻击:在 $\epsilon \leq 4/255$ 下重写感知
It Takes Little to Rewrite Perception: Targeted Semantic Substitution in Vision-Language Models at $\epsilon \leq 4/255$
AI brief
论文提出在 VLM post-merger token 空间对齐源图像与目标图像的白盒攻击,在 $\varepsilon \leq 4/255$ 范围内实现目标语义替换。
Why it matters
在极低扰动下即可实现视觉语义替换,提示现有 VLM 安全评估基准可能需要重新审视。
Source: arXiv · Computer Vision · arxiv.org