模型安全武装,复旦新研究实现SOTA扩散模型风险概念擦除效果,入选AAAI 2025
AIxiv专栏是机器之心发布学术、技术内容的栏目。过去数年,机器之心AIxiv专栏接收报道了2000多篇内容,覆盖全球各大高校与企业的顶级实验室,有效促进了学术交流与传播。如果您有优秀的工作想要分享,欢迎投稿或者联系报道。投稿邮箱:[email protected];[email protected]
论文:DuMo: Dual Encoder Modulation Network for Precise Concept Erasure 论文链接:https://arxiv.org/abs/2501.01125
裸体部位检测数量仅为 34 个,是现有最佳方法。
生成图像的质量指标(FID)与 CLIP Score 均达到顶尖水平,生成能力显著优于其他方法。
单概念擦除任务中,LPIPS_da(擦除效果 - 生成能力保留平衡性)提升了 0.096;
多概念擦除任务中,LPIPS_da 进一步提升了 0.142,证明其对复杂任务的优异适应性。
实现了 SOTA 级别的风格擦除效果;
定量指标 LPIPS_da 表现显著优于对比方法。