控制与决策

北大核心,JST,Pж(AJ),EI,CSCD

国内刊号:21-1124/TP

国际刊号:1001-0920

控制与决策杂志2022年第12期:基于深度/单目融合视觉及强化学习的机器人定位棋局与行棋策略

发布日期:

作者:吴启宇,谢非,黄磊,刘宗熙,赵静,刘锡祥

单位:南京师范大学 电气与自动化工程学院,南京 210023,,南京师范大学 电气与自动化工程学院,南京 210023,,南京林业大学 机械电子工程学院,南京 210037,,南京师范大学 电气与自动化工程学院,南京 210023,,南京邮电大学 自动化学院、人工智能学院,南京 210003,,东南大学 仪器工程与科学学院,南京 210018,

关键词:中国象棋;行棋策略;目标检测;深度图像;蒙特卡洛树搜索;强化学习

基金:国家自然科学基金项目(41974033);江苏省科技成果转化项目(BA2020004);江苏省省级工业和信息产业转型升级专项资金项目(JITC-2000AX0676-71);南京市优势产业关键技术突破招标项目(2018003).

中国象棋对弈机器人系统实现的关键包括棋局识别定位和自主行棋策略.\:首先,针对棋局识别与定位问题,提出一种基于单目相机与深度相机视觉融合的棋局识别定位方法.\:该方法利用立体棋子三维特征获取棋子位置,与二维图像识别结果融合计算定位,以提高棋子的识别定位精度.\:其次,针对行棋策略问题,提出一种基于深度神经网络与蒙特卡洛树搜索的决策方法.\:该方法利用具有终局特征判断的蒙特卡洛树进行搜索,使用优化的随机行棋策略指导模拟行棋,训练具有多尺度及残差结构的策略价值网络模型.\:最后,通过自对弈获取训练数据,通过智能体对抗验证、更新模型参数.\:实验表明,相较于单目视觉识别,所提出方法具有更高的精确度和稳定性,识别率达到97%;相较于基准剪枝搜索算法,所提出方法对弈时最多赢得82%的对局,且所需运算时间缩短41%.

来源:2022年第12期

《控制与决策》期刊编辑部

查看控制与决策杂志2022年第12期

联系我们

  • 地址:沈阳市和平区文化路3巷11号
  • 电话:024-83687766
  • E-mail:kzyjc@mail.neu.edu.cn

咨询工作人员