国内刊号:31-1289/TP
国际刊号:1000-3428
发布日期:
作者:王雯, 杨奎武, 仝松松, 魏江宏, 薛岩, 周荣魁
单位:中国人民解放军网络空间部队信息工程大学数据与目标工程学院, 河南 郑州 450001
关键词:深度学习,模型安全,水印技术,人工智能(AI)安全,版权保护
基金:国家自然科学基金(62172434); 河南省高等教育教学改革研究与实践项目(2024SJGLX0095)
模型知识产权保护已成为模型安全中不可忽视的问题, 水印技术作为模型溯源的核心手段, 通过将特殊标识嵌入模型参数或生成内容中, 为版权验证提供技术支撑。然而, 训练完成的含水印模型非常容易被复制并扩散, 这使得攻击者能够通过微调、剪枝或对抗样本攻击等特定技术手段, 破坏或去除深度神经网络(DNN)模型中嵌入的水印, 使得模型所有权无法验证。为了更深入地了解模型水印攻击方法, 首先对模型水印攻击进行介绍, 然后对模型水印攻击方法进行分类, 根据攻击者对目标模型的访问权限和信息获取能力, 分为白盒水印攻击和黑盒水印攻击两类, 对DNN模型水印攻击的动因、危害、攻击原理和具体实施手段进行梳理和分析, 接着对现有模型水印攻击研究从攻击者能力及性能影响等方面进行比较与总结, 最后探讨了神经网络模型水印攻击在未来研究中的潜在积极作用, 为模型安全和知识产权保护领域的深入研究提供建议。
来源:2026年第4期
《计算机工程》期刊编辑部