VETO:保护图像免受前沿AI编辑
随着强大且易用的图像编辑模型如FLUX.2的兴起,高保真图像编辑变得更加普及。这些模型的能力不仅限于局部修改,还能将对象和身份提取并重新置于全新场景中。现代模型通过允许提示和生成令牌直接关注参考图像令牌,模糊了传统编辑与文本到图像生成的界限。这种生成自由的扩展也扩大了潜在滥用的空间,恶意的转换不再局限于可预测的局部编辑。现有的反编辑防护设计用于破坏传统扩散模型中参考图像编码的语义瓶颈,但新型编辑器通过联合注意力模块来提取参考信息,常常绕过这些防护。为此,我们提出VETO,一种通过扰乱现代模型读取源图像的内机制的细微反编辑保护。此外,鉴于现有编辑基准主要测试局部编辑,忽视了全面的重新语境化,我们引入VetoBench,评估防护在传统局部编辑和广泛语境变化上的效果。在两种最新编辑模型和三个基准测试中,VETO始终优于现有防护,同时提供更优越的保护与图像质量权衡。
这条 研究论文 信号说明,来自 arXiv cs.CV 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。