国内刊号:21-1124/TP
国际刊号:1001-0920
发布日期:
作者:罗俊仁,张万鹏,谷学强,陈璟
单位:国防科技大学 智能科学学院,长沙 410073,,国防科技大学 智能科学学院,长沙 410073,,国防科技大学 智能科学学院,长沙 410073,,国防科技大学 智能科学学院,长沙 410073,
关键词:海上基地;安全博弈;资源分配;反事实遗憾最小化;可配置
基金:国家自然科学基金项目(61702528).
围绕海上基地的攻防可看作一个多阶段序贯对抗过程, 通常可建模为不完美信息零和博弈. 针对海上基地防护安全博弈问题, 构建不完美信息序贯博弈模型, 分析博弈模型各要素; 围绕近似纳什均衡策略的快速求解, 提出可配置反事实遗憾最小化(CogCFR)算法, 利用基类CFR算法与元控制器可动态控制CFR的超参数; 以海上多个海上基地防护为试验背景, 利用CogCFR求解海上基地防护资源分配策略. 针对有限理性对手, 提出考虑约束的单侧信任域鲁棒对手利用策略更新方式. 实验结果表明: 可配置反事实遗憾最小化相比动态加权反事实遗憾最小化计算时效性更强、参数更少; 算法具有较好的应用可行性和领域泛化性, 可为序贯交互类博弈对抗问题策略求解提供参考.
来源:2025年第8期
《控制与决策》期刊编辑部