国内刊号:21-1124/TP
国际刊号:1001-0920
发布日期:
作者:李晓豪,郑海斌,王雪柯,张京京,陈晋音,王巍,赵文红
单位:浙江工业大学 网络空间安全研究院,杭州 310023;浙江工业大学 信息工程学院,杭州 310023,,浙江工业大学 网络空间安全研究院,杭州 310023;浙江工业大学 信息工程学院,杭州 310023,,浙江工业大学 网络空间安全研究院,杭州 310023;浙江工业大学 信息工程学院,杭州 310023,,信息安全国家重点实验室,北京 100039,,浙江工业大学 网络空间安全研究院,杭州 310023;浙江工业大学 信息工程学院,杭州 310023,,中国电子科技集团公司第三十六研究所,浙江 嘉兴 314001,,嘉兴南湖学院 信息工程学院,浙江 嘉兴 314001,
关键词:模仿学习;鲁棒性增强;改进交叉熵;噪声网络;对抗攻击
基金:国家自然科学基金项目(62072406);浙江省自然科学基金项目(LY19F020025);宁波市“科技创新2025”重大专项项目(2018B10063);科技创新2030-----“新一代人工智能”重大项目(2018AAA0100801);浙江省重点研发计划项目(2021C01117);浙江省“万人计划”科技创新领军人才项目(2020R52011).
模仿学习是一种模仿专家示例的学习模式,需要大量数据样本进行监督训练,如果专家示例掺杂恶意样本或探索数据受到噪声干扰,则影响学徒学习并累积学习误差;另一方面,模仿学习使用的深度模型容易受到对抗攻击.针对模仿学习的模型安全问题,从模型损失以及模型结构两个方面分别进行防御.在模型损失方面,提出基于改进交叉熵的模仿学习鲁棒性增强方法;在模型结构方面,利用噪声网络模型提高模仿学习的鲁棒性,并结合改进交叉熵提高模型对对抗样本的抵御能力.使用3种白盒攻击及1种黑盒攻击方法进行防御性能验证,以生成对抗模仿学习为例,通过各种攻击策略验证所提出的鲁棒性增强方法的可行性以及模仿学习的脆弱性,并对模型的鲁棒性增强效果进行评估.
来源:2024年第3期
《控制与决策》期刊编辑部