控制与决策

北大核心,JST,Pж(AJ),EI,CSCD

国内刊号:21-1124/TP

国际刊号:1001-0920

控制与决策杂志2025年第12期:一种基于多假设交互的三维人体姿态估计模型

发布日期:

作者:胡楠,张家豪,魏晓彤,朱宏博

单位:沈阳建筑大学 电气与控制工程学院,沈阳 110168,,沈阳建筑大学 电气与控制工程学院,沈阳 110168,,中国医科大学 医学教育评价与改革研究院,沈阳 110122,,沈阳理工大学 信息科学与工程学院,沈阳 110623,

关键词:三维人体姿态估计;卷积神经网络;混合注意力机制;混合多假设;自假设精细;跨假设交互

基金:国家自然科学基金项目(72204267);教育厅基本科研项目面上项目(JYTMS20231576);辽宁省教育厅基本科研一般项目(LJ212410144025).

近年来, 基于Transformer的方法在三维人体姿态估计任务中表现出色, 然而, 现有方法虽能通过全局自注意力机制有效建模关节间长程依赖关系, 但在肢体快速运动等场景下易产生局部运动轨迹预测偏差, 存在对局部运动特征建模不足问题. 鉴于此, 提出一种结合卷积神经网络(CNN)与混合注意力机制的Transformer架构模型, 通过加入卷积特征提取, 显著增强局部关节运动表征能力. 首先, 设计混合多假设生成模块, 兼顾效率的同时生成更丰富的假设信息, 有效弥补传统全局视角方法在捕捉局部依赖关系上的不足; 然后, 使用自假设精细化模块进一步挖掘数据中的多样化信息, 确保模型能够捕捉到更多细节; 最后, 通过跨假设交互模块充分融合不同假设间的特征信息, 增强模型的鲁棒性和精度. 实验结果表明, 该模型在数据集Human3.6M上的表现相较于基准模型MHFormer提升了7.99%, 表明了所提出组件与整体架构在三维人体姿态估计领域的有效性.

来源:2025年第12期

《控制与决策》期刊编辑部

查看控制与决策杂志2025年第12期

联系我们

  • 地址:沈阳市和平区文化路3巷11号
  • 电话:024-83687766
  • E-mail:kzyjc@mail.neu.edu.cn

咨询工作人员