控制与决策

北大核心,JST,Pж(AJ),EI,CSCD

国内刊号:21-1124/TP

国际刊号:1001-0920

控制与决策杂志2024年第4期:基于多起点和Mask策略的深度强化学习算法求解覆盖旅行商问题

发布日期:

作者:方伟,接中冰,陆恒杨,张涛

单位:江南大学 江苏省人工智能国际合作联合实验室, 江苏 无锡 214122;江南大学 江苏省模式识别与 计算智能工程实验室,江苏 无锡 214122,,江南大学 江苏省人工智能国际合作联合实验室, 江苏 无锡 214122;江南大学 江苏省模式识别与 计算智能工程实验室,江苏 无锡 214122,,江南大学 江苏省人工智能国际合作联合实验室, 江苏 无锡 214122;江南大学 江苏省模式识别与 计算智能工程实验室,江苏 无锡 214122,,中国船舶科学研究中心,江苏 无锡 214082,

关键词:覆盖旅行商;深度强化学习;组合优化;多起点;Mask策略

基金:国家自然科学基金项目(62073155,62002137,62106088,62206113);船舶总体性能创新研究开放基金项目(22422213).

覆盖旅行商问题(covering salesman problem,CSP) 是旅行商问题的变体,在防灾规划、急救管理中有着广泛应用.由于传统方法求解问题实例耗时严重,近年来深度神经网络被提出用于解决该类组合优化问题,在求解速度和泛化性上有明显的优势.现有基于深度神经网络求解CSP的方法求解质量较低,特别在大规模实例上与传统的启发式方法相比存在较大差距.针对上述问题,提出一种新的基于深度强化学习求解CSP的方法,由编码器对输入特征进行编码,提出新的Mask策略对解码器使用自注意力机制构造解的过程进行约束,并提出多起点策略改善训练过程、提高求解质量.实验结果表明,所提方法对比现有基于深度神经网络的求解方法进一步缩小了最优间隙,同时有着更高的样本效率,在不同规模和不同覆盖类型的CSP中展现出更强的泛化能力,与启发式算法相比在求解速度上有10sim40倍的提升.

来源:2024年第4期

《控制与决策》期刊编辑部

查看控制与决策杂志2024年第4期

声明

严正声明:本站非期刊官网,非中介代理。

本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。

联系我们

  • 地址:沈阳市和平区文化路3巷11号
  • 电话:024-83687766
  • E-mail:kzyjc@mail.neu.edu.cn

咨询工作人员