国内刊号:21-1124/TP
国际刊号:1001-0920
发布日期:
作者:董豪,杨静,李少波,王军,段仲静
单位:贵州大学 机械工程学院,贵阳 550025,,贵州大学 机械工程学院,贵阳 550025;贵州大学 省部共建公共大数据国家重点实验室筹, 贵阳 550025,,贵州大学 机械工程学院,贵阳 550025;贵州大学 省部共建公共大数据国家重点实验室筹, 贵阳 550025;贵州大学 现代制造技术教育部重点实验室,贵阳 550025,,贵州大学 机械工程学院,贵阳 550025,,贵州大学 现代制造技术教育部重点实验室,贵阳 550025,
关键词:复杂未知环境;人工智能;高维连续空间;深度强化学习;仿真至现实;机器人运动控制
基金:国家重点研发计划项目(2018AAA0101803);国家自然科学基金项目(51475097,91746116);工信部资助项目(工信部联装[2016]213号);贵州省科技计划项目(黔科合人才[2015]4011);贵州省重点实验室建设项目(黔科合平台人才[2016]5103));贵州大学培育项目(贵大培育[2019]22号).
复杂未知环境下智能感知与自动控制是目前机器人在控制领域的研究热点之一,而新一代人工智能为其实现智能自动化赋予了可能.近年来,在高维连续状态-动作空间中,尝试运用深度强化学习进行机器人运动控制的新兴方法受到了相关研究人员的关注.首先,回顾了深度强化学习的兴起与发展,将用于机器人运动控制的深度强化学习算法分为基于值函数和策略梯度2类,并对各自典型算法及其特点进行了详细介绍;其次,针对仿真至现实之前的学习过程,简要介绍5种常用于深度强化学习的机器人运动控制仿真平台;然后,根据研究类型的不同,综述了目前基于深度强化学习的机器人运动控制方法在自主导航、物体抓取、步态控制、人机协作以及群体协同等5个方面的研究进展;最后,对其未来所面临的挑战以及发展趋势进行了总结与展望.
来源:2022年第2期
《控制与决策》期刊编辑部