国内刊号:21-1124/TP
国际刊号:1001-0920
发布日期:
作者:王浩宇,张欣然,王雪松,程玉虎
单位:中国矿业大学 信息与控制工程学院,江苏 徐州 221116,,中国矿业大学 信息与控制工程学院,江苏 徐州 221116,,中国矿业大学 信息与控制工程学院,江苏 徐州 221116,,中国矿业大学 信息与控制工程学院,江苏 徐州 221116,
关键词:零样本学习;自监督学习;直推式;视觉-语义映射;特征融合;图像分类
基金:国家自然科学基金项目(62176259,61976215);江苏省自然科学基金项目(BK20221116);江苏省卓越博士后计划项目(2022ZB530).
图像的视觉特征对实现零样本图像分类有至关重要的作用.尽管目前VGG、GoogLeNet和ResNet等网络提取的深度特征在图像分类领域获得了广泛的应用,但其在零样本图像分类问题上的表现并不理想,仍旧存在较大的提升空间.此外,由于零样本学习场景下训练集与测试集不相交的设定,导致分类网络不可避免地存在领域偏移问题.为此,提出一种基于自监督增强特征的直推式零样本图像分类框架.首先,通过辅助任务构造伪标签,利用自监督学习获得图像的自监督特征并将其与无监督深度特征进行特征融合;然后,将融合特征嵌入语义空间中进行零样本图像分类,并获得未见类的初始预测标签;最后,利用未见类特征和预测标签迭代地优化视觉-语义映射.所提出框架组件可选择,框架组件自监督网络、主干网络和降维网络分别选用CFN、VGG16和PCA构成网络.在CUB、SUN和AwA2数据集上的实验结果表明,所提出网络能够增强特征的判别能力,在零样本图像分类问题上表现良好.
来源:2024年第5期
《控制与决策》期刊编辑部