AI 产品
VJA攻击方法在ICML 2026展示,可隐藏恶意指令绕过图像编辑器安全过滤
在ICML 2026会议上,研究人员介绍了VJA攻击技术。该方法利用现代图像编辑器对绘画、箭头和涂鸦的理解能力,将恶意指令隐藏在图像本身中,从而绕过基于文本的安全过滤器。实验表明,在先进商业模型上攻击成功率高达80.9%。研究还构建了IESBench基准测试和免训练防御方案。论文已发布。
多来源证据
事件时间线
- Twitter/X AI ListVJA: ICML 2026口头报告 🚨
AI 产品
在ICML 2026会议上,研究人员介绍了VJA攻击技术。该方法利用现代图像编辑器对绘画、箭头和涂鸦的理解能力,将恶意指令隐藏在图像本身中,从而绕过基于文本的安全过滤器。实验表明,在先进商业模型上攻击成功率高达80.9%。研究还构建了IESBench基准测试和免训练防御方案。论文已发布。