声明
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。
国内刊号:21-1124/TP
国际刊号:1001-0920
发布日期:
作者:乔贝贝,刘薛怡,钱寒雨,许静文,肖冰
单位:西北工业大学 自动化学院,西安 710072,,西北工业大学 自动化学院,西安 710072,,西北工业大学 自动化学院,西安 710072,,西北工业大学 航天学院,西安 710072,,西北工业大学 自动化学院,西安 710072,
关键词:航天器追逃;轨道博弈;机动决策;可达域;层次强化学习
基金:国家自然科学基金项目(62273277).
针对在复杂空间博弈场景中, 脉冲推力驱动的航天器追逃博弈决策实时性受限和传统奖励函数较难适应远距离和高动态对抗学习环境的问题, 对航天器博弈对抗的智能机动决策和燃料优化展开研究. 首先, 建立轨道博弈动力学和机动约束模型; 然后, 提出一种具有时间约束的航天器单脉冲可达域求解方法, 并结合神经网络对轨道危险区进行量化拟合; 接着, 基于分布式系统架构设计层次强化学习框架, 采用近端策略优化(PPO)算法开展红蓝对抗学习训练; 最后, 对所提出机动策略进行验证. 仿真结果表明, 在二体动力学轨道博弈场景中, 危险区策略可使得平均燃料消耗降低33.81%, 博弈策略相较于传统方法打靶率平均可提升38.41%.
来源:2025年第12期
《控制与决策》期刊编辑部
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。