国内刊号:21-1124/TP
国际刊号:1001-0920
发布日期:
作者:温广辉,杨涛,周佳玲,付俊杰,徐磊
单位:东南大学 系统科学系,南京 211189,,东北大学 流程工业综合自动化国家重点实验室,沈阳 110819,,北京理工大学 前沿交叉科学研究院,北京 100081,,东南大学 系统科学系,南京 211189,,东北大学 流程工业综合自动化国家重点实验室,沈阳 110819,
关键词:强化学习;自适应动态规划;多智能体系统;马尔科夫决策过程;序贯决策;最优协调控制
基金:国家自然科学基金项目(U22B2046,62073079,62088101,62133003,61991403,62173085,62003167);装备预研教育部联合基金项目(8091B022114).
近年来,强化学习与自适应动态规划算法的迅猛发展及其在一系列挑战性问题(如大规模多智能体系统优化决策和最优协调控制问题)中的成功应用,使其逐渐成为人工智能、系统与控制和应用数学等领域的研究热点.鉴于此,首先简要介绍强化学习和自适应动态规划算法的基础知识和核心思想,在此基础上综述两{类
来源:2023年第5期
《控制与决策》期刊编辑部