摘要

深度长尾学习是视觉识别中最具挑战性的问题之一,其目标是从大量遵循长尾类分布的图像中训练出性能良好的深度模型。在过去的十年中,深度学习已经成为一种学习高质量图像表示的强大的识别模型,并导致了一般视觉识别的显著突破。然而,长尾类不平衡是实际视觉识别任务中普遍存在的问题,这种不平衡往往限制了基于深度网络的识别模型在实际应用中的实用性,因为长尾类容易偏向主导类,在尾类上的表现较差。为了解决这一问题,近年来人们进行了大量的研究,在深度长尾学习领域取得了可喜的进展。鉴于该领域的快速发展,本文对深度长尾学习的最新进展进行了综述。具体地说,我们将已有的深度长尾学习研究分为三类(即类重平衡、信息增强和模块改进),并根据这三类对这些方法进行了详细的回顾。之后,我们通过一种新提出的评价指标,即相对准确性,来评估它们在多大程度上解决了阶级失衡问题,从而对几种最先进的方法进行了实证分析。最后,我们强调了深度长尾学习的重要应用,并确定了未来研究的几个有前景的方向。

引言

深度学习允许由多个处理层组成的计算模型学习具有多级抽象[1]、[2]的数据表示,并在计算机视觉[3]、[4]、[5]、[6]、[7]、[8]方面取得了令人难以置信的进展。深度学习的关键因素是大规模数据集的可用性、GPU的出现和深度网络架构[9]的进步。深度神经网络具有很强的学习高质量数据表示的能力,在图像分类[6]、[10]、目标检测[7]、[11]和语义分割[8]、[12]等视觉识别任务中取得了巨大的成功。

在实际应用中,训练样本通常表现为长尾类分布,其中一小部分类有大量的样本点,而其他类只与少数样本[13],[14],[15],[16]相关。然而,这种训练样本数量的类不平衡,使得基于深度网络的识别模型的训练非常具有挑战性。如图1所示,训练后的模型容易偏向训练数据量大的头类,导致模型在数据量有限的尾类上表现不佳。因此,经验风险最小化[20]常用实践训练的深度模型无法处理长尾类不平衡的现实应用,如人脸识别[21],[22],物种分类[23],[24],医学图像诊断[25],城市场景理解[26],无人机检测[27]。针对长尾类的不平衡,近年来开展了大量的深度长尾学习研究,包括[15]、[16]、[28]、[29]、[30]。尽管这一领域发展迅速,但仍没有系统的研究来回顾和讨论现有的进展。为了填补这一空白,我们旨在对2021年年中之前进行的近期长尾学习研究进行全面综述。

如图2所示,我们根据现有方法的主要技术贡献将其分为三类,即类重平衡、信息增强和模块改进;这些类别可以进一步分为九个子类别:重采样、代价敏感学习、logit调整、迁移学习、数据增强、表示学习、分类器设计、解耦训练和集成学习。根据这一分类,我们对现有的方法进行了全面的回顾,并对几种最先进的方法进行了实证分析,使用一个新的评价指标,即相对准确性来评价它们处理类不平衡的能力。我们通过介绍几个真实的深度长尾学习的应用场景,并确定了几个有前景的研究方向,可以由社区在未来探索。

我们总结了这项综述的主要贡献如下。

• 据我们所知,这是第一次对深度长尾学习的全面调研,将为研究人员和社区提供对深度神经网络的长尾视觉学习的更好理解。

• 我们提供了对高级长尾学习研究的深入回顾,并通过一个新的相对准确性度量来评估它们在多大程度上处理长尾类别失衡,以实证研究最先进的方法。

• 我们为未来的研究确定了四个潜在的方法创新方向以及八个新的深度长尾学习任务设置。

第二节介绍了问题的定义,并介绍了广泛使用的数据集、度量和网络骨架。第3节全面回顾了先进的长尾学习方法,第4节基于一个新的评价指标实证分析了几种最先进的方法。第5节给出了深度长尾学习的应用场景,第6节给出了未来的研究方向。我们在第7节结束调研。

成为VIP会员查看完整内容
58

相关内容

在深度学习中,卷积神经网络(CNN或ConvNet)是一类深度神经网络,最常用于分析视觉图像。基于它们的共享权重架构和平移不变性特征,它们也被称为位移不变或空间不变的人工神经网络(SIANN)。它们在图像和视频识别,推荐系统,图像分类,医学图像分析,自然语言处理,和财务时间序列中都有应用。

知识荟萃

精品入门和进阶教程、论文和代码整理等

更多

查看相关VIP内容、论文、资讯等
图嵌入推荐系统技术综述,64页pdf422篇文献
专知会员服务
61+阅读 · 2021年9月22日
专知会员服务
89+阅读 · 2021年8月29日
专知会员服务
7+阅读 · 2021年4月20日
专知会员服务
48+阅读 · 2020年12月28日
专知会员服务
32+阅读 · 2020年12月25日
【文本分类大综述:从浅层到深度学习,35页pdf】
专知会员服务
183+阅读 · 2020年8月6日
深度学习目标检测方法综述
专知会员服务
258+阅读 · 2020年8月1日
《小样本元学习》2020最新综述论文
专知会员服务
172+阅读 · 2020年7月31日
【文献综述】深度学习目标检测方法及其主流框架综述
专知会员服务
114+阅读 · 2020年6月26日
基于深度学习的单目深度估计综述
CVer
4+阅读 · 2020年10月6日
最新《多任务学习》综述,39页pdf
专知
28+阅读 · 2020年7月10日
最全综述 | 医学图像处理
计算机视觉life
55+阅读 · 2019年6月15日
图数据表示学习综述论文
专知
52+阅读 · 2019年6月10日
综述 | 近5年基于深度学习的目标检测算法
计算机视觉life
36+阅读 · 2019年4月18日
人脸识别研究取得进展
中科院之声
4+阅读 · 2019年3月26日
生成对抗网络的最新研究进展
AI科技评论
5+阅读 · 2019年2月6日
深度学习时代的目标检测算法综述
AI前线
10+阅读 · 2017年9月22日
Arxiv
7+阅读 · 2021年8月25日
Deep Face Recognition: A Survey
Arxiv
17+阅读 · 2019年2月12日
Arxiv
11+阅读 · 2018年1月18日
Arxiv
5+阅读 · 2017年7月25日
VIP会员
相关VIP内容
图嵌入推荐系统技术综述,64页pdf422篇文献
专知会员服务
61+阅读 · 2021年9月22日
专知会员服务
89+阅读 · 2021年8月29日
专知会员服务
7+阅读 · 2021年4月20日
专知会员服务
48+阅读 · 2020年12月28日
专知会员服务
32+阅读 · 2020年12月25日
【文本分类大综述:从浅层到深度学习,35页pdf】
专知会员服务
183+阅读 · 2020年8月6日
深度学习目标检测方法综述
专知会员服务
258+阅读 · 2020年8月1日
《小样本元学习》2020最新综述论文
专知会员服务
172+阅读 · 2020年7月31日
【文献综述】深度学习目标检测方法及其主流框架综述
专知会员服务
114+阅读 · 2020年6月26日
相关资讯
基于深度学习的单目深度估计综述
CVer
4+阅读 · 2020年10月6日
最新《多任务学习》综述,39页pdf
专知
28+阅读 · 2020年7月10日
最全综述 | 医学图像处理
计算机视觉life
55+阅读 · 2019年6月15日
图数据表示学习综述论文
专知
52+阅读 · 2019年6月10日
综述 | 近5年基于深度学习的目标检测算法
计算机视觉life
36+阅读 · 2019年4月18日
人脸识别研究取得进展
中科院之声
4+阅读 · 2019年3月26日
生成对抗网络的最新研究进展
AI科技评论
5+阅读 · 2019年2月6日
深度学习时代的目标检测算法综述
AI前线
10+阅读 · 2017年9月22日
微信扫码咨询专知VIP会员