172篇文献：NUS颜水成等发布首篇《深度长尾学习》综述

会员服务 ·

172篇文献：NUS颜水成等发布首篇《深度长尾学习》综述

2021 年 12 月 28 日 极市平台

↑ 点击蓝字关注极市平台

来源丨新智元

编辑丨极市平台

极市导读

深度学习依赖于大量数据，但对于长尾类别来说，数据样本较为稀缺。为此，深度长尾学习从大量遵循长尾类分布的图像中训练出性能良好的深度模型，得到大量研究。来自NUS的颜水成等学者发布了首篇《深度长尾学习》综述论文，值得关注！>>加入极市CV技术交流群，走在计算机视觉的最前沿

论文链接： https://arxiv.org/abs/2110.04596

公众号后台回复” 长尾学习综述“ 获取本文PDF

摘要

深度长尾学习是视觉识别中最具挑战性的问题之一，其目标是从大量遵循长尾类分布的图像中训练出性能良好的深度模型。在过去的十年中，深度学习已经成为一种学习高质量图像表示的强大的识别模型，并导致了一般视觉识别的显著突破。

然而，长尾类不平衡是实际视觉识别任务中普遍存在的问题，这种不平衡往往限制了基于深度网络的识别模型在实际应用中的实用性，因为长尾类容易偏向主导类，在尾类上的表现较差。

为了解决这一问题，近年来人们进行了大量的研究，在深度长尾学习领域取得了可喜的进展。鉴于该领域的快速发展，本文对深度长尾学习的最新进展进行了综述。

具体地说，我们将已有的深度长尾学习研究分为三类(即类重平衡、信息增强和模块改进)，并根据这三类对这些方法进行了详细的回顾。

之后，我们通过一种新提出的评价指标，即相对准确性，来评估它们在多大程度上解决了阶级失衡问题，从而对几种最先进的方法进行了实证分析。

最后，我们强调了深度长尾学习的重要应用，并确定了未来研究的几个有前景的方向。

引言

深度学习允许由多个处理层组成的计算模型学习具有多级抽象的数据表示，并在计算机视觉任务方面取得了令人难以置信的进展。

深度学习的关键因素是大规模数据集的可用性、GPU的出现和深度网络架构[9]的进步。深度神经网络具有很强的学习高质量数据表示的能力，在图像分类、目标检测和语义分割等视觉识别任务中取得了巨大的成功。

在实际应用中，训练样本通常表现为长尾类分布，其中一小部分类有大量的样本点，而其他类只与少数样本相关。然而，这种训练样本数量的类不平衡，使得基于深度网络的识别模型的训练非常具有挑战性。如图1所示，训练后的模型容易偏向训练数据量大的头类，导致模型在数据量有限的尾类上表现不佳。

因此，经验风险最小化常用实践训练的深度模型无法处理长尾类不平衡的现实应用，如人脸识别，物种分类，医学图像诊断，城市场景理解，无人机检测等。

针对长尾类的不平衡，近年来开展了大量的深度长尾学习研究。尽管这一领域发展迅速，但仍没有系统的研究来回顾和讨论现有的进展。

为了填补这一空白，我们旨在对2021年年中之前进行的近期长尾学习研究进行全面综述。

如图2（下图）所示，我们根据现有方法的主要技术贡献将其分为三类，即类重平衡、信息增强和模块改进; 这些类别可以进一步分为九个子类别:重采样、代价敏感学习、logit调整、迁移学习、数据增强、表示学习、分类器设计、解耦训练和集成学习。

根据这一分类，我们对现有的方法进行了全面的回顾，并对几种最先进的方法进行了实证分析，使用一个新的评价指标，即相对准确性来评价它们处理类不平衡的能力。我们通过介绍几个真实的深度长尾学习的应用场景，并确定了几个有前景的研究方向，可以由社区在未来探索。

我们总结了这项综述的主要贡献如下。

• 据我们所知，这是第一次对深度长尾学习的全面调研，将为研究人员和社区提供对深度神经网络的长尾视觉学习的更好理解。

• 我们提供了对高级长尾学习研究的深入回顾，并通过一个新的相对准确性度量来评估它们在多大程度上处理长尾类别失衡，以实证研究最先进的方法。

• 我们为未来的研究确定了四个潜在的方法创新方向以及八个新的深度长尾学习任务设置。

第二节介绍了问题的定义，并介绍了广泛使用的数据集、度量和网络骨架。第3节全面回顾了先进的长尾学习方法，第4节基于一个新的评价指标实证分析了几种最先进的方法。第5节给出了深度长尾学习的应用场景，第6节给出了未来的研究方向。我们在第7节结束调研。

如果觉得有用，就请分享到朋友圈吧！

△点击卡片关注极市平台，获取最新CV干货

公众号后台回复“transformer”获取最新Transformer综述论文下载～

极市干货

课程/比赛：珠港澳人工智能算法大赛｜保姆级零基础人工智能教程

算法trick ：目标检测比赛中的tricks集锦｜从39个kaggle竞赛中总结出来的图像分割的Tips和Tricks

技术综述：一文弄懂各种loss function ｜工业图像异常检测最新研究总结（2019-2020）

# CV技术社群邀请函 #

△长按添加极市小助手

添加极市小助手微信（ID : cvmart4）

备注：姓名-学校/公司-研究方向-城市（如：小极-北大-目标检测-深圳）

即可申请加入极市目标检测/图像分割/工业检测/人脸/医学影像/3D/SLAM/自动驾驶/超分辨率/姿态估计/ReID/GAN/图像增强/OCR/视频理解等技术交流群

每月大咖直播分享、真实项目需求对接、求职内推、算法竞赛、干货资讯汇总、与 10000+来自港科大、北大、清华、中科院、CMU、腾讯、百度等名校名企视觉开发者互动交流~

觉得有用麻烦给个在看啦~

登录查看更多

相关内容

深度长尾学习

关注 1

南大发布首篇《健壮深度半监督学习》综述论文，全面阐述现有RDSSL技术体系与进展

专知会员服务

39+阅读 · 2022年2月17日

场景图生成:一个全面综述

专知会员服务

67+阅读 · 2022年1月4日

重邮高新波等最新《少样本目标检测算法》综述论文

专知会员服务

35+阅读 · 2021年11月2日

【NUS】深度长尾学习综述，20页pdf172篇文献

专知会员服务

59+阅读 · 2021年10月14日

基于深度神经网络的高效视觉识别研究进展与新方向

专知会员服务

39+阅读 · 2021年8月31日

【TPAMI2021】视觉智能的知识蒸馏与师生学习:回顾与展望, 20页pdf与218篇文献

专知会员服务

52+阅读 · 2021年8月4日

卷积神经网络表征可视化研究综述

专知会员服务

42+阅读 · 2021年6月21日

深度神经网络模型压缩综述

专知会员服务

117+阅读 · 2020年8月22日

基于深度神经网络的少样本学习综述

专知会员服务

173+阅读 · 2020年4月22日

基于深度网络的自监督视觉特征学习综述，附24页论文下载

专知会员服务

66+阅读 · 2020年1月15日

华东师大最新《无数据知识迁移》综述论文，阐述知识蒸馏和无监督领域适应进展

专知

2+阅读 · 2022年1月6日

正视长尾挑战！颜水成、冯佳时团队发布首篇《深度长尾学习》综述

PaperWeekly

0+阅读 · 2021年11月14日

综述｜重邮高新波等最新《少样本目标检测算法》

极市平台

1+阅读 · 2021年11月4日

领域自适应研究综述

专知

6+阅读 · 2021年5月5日

阿斯隆理工大学 | 深度学习目标检测模型2021年最新综述！

专知

1+阅读 · 2021年5月2日

多模态视觉语言表征学习研究综述

专知

27+阅读 · 2020年12月3日

《文本分类大综述：从浅层到深度学习》最新2020版35页pdf

专知

59+阅读 · 2020年8月6日

综述 | 近5年基于深度学习的目标检测算法

计算机视觉life

38+阅读 · 2019年4月18日

大数据时代小样本如何学习？看这篇最新《小样本学习方法综述》论文

专知

127+阅读 · 2019年3月31日

迁移自适应学习最新综述，附21页论文下载

专知

34+阅读 · 2019年3月13日

拼装式盾构结构服役性能退化模型及在隧道维养应用中研究

国家自然科学基金

0+阅读 · 2014年12月31日

特征空间中的稀疏表示及其分类研究

国家自然科学基金

2+阅读 · 2014年12月31日

基于弱监督学习的图像语义分割研究

国家自然科学基金

4+阅读 · 2014年12月31日

基于约束条件的非负矩阵分解算法及其在纤维自动识别中的应用研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于多示例学习和半监督学习的手势语识别的研究

国家自然科学基金

0+阅读 · 2013年12月31日

基于多源影像的显著性检测及其在图像缩放中的应用

国家自然科学基金

0+阅读 · 2012年12月31日

退化图像不变性识别研究

国家自然科学基金

0+阅读 · 2012年12月31日

基于先验知识的三维点云鲁棒处理技术研究

国家自然科学基金

1+阅读 · 2012年12月31日

面向高维小样本数据的集成分类方法研究

国家自然科学基金

4+阅读 · 2012年12月31日

半监督鉴别特征抽取及人脸识别应用研究

国家自然科学基金

0+阅读 · 2008年12月31日

Fully Dynamic All Pairs All Shortest Paths

Arxiv

0+阅读 · 2022年4月20日

Less than Few: Self-Shot Video Instance Segmentation

Arxiv

0+阅读 · 2022年4月19日

Automated Application Processing

Arxiv

1+阅读 · 2022年4月19日

Extracting and Inferring Personal Attributes from Dialogue

Arxiv

0+阅读 · 2022年4月19日

UNBUS: Uncertainty-aware Deep Botnet Detection System in Presence of Perturbed Samples

Arxiv

1+阅读 · 2022年4月18日

Homogeneity in the instrument-treatment association is not sufficient for the Wald estimand to equal the average causal effect for a binary instrument and a continuous exposure

Arxiv

0+阅读 · 2022年4月18日

Novelty Search in Representational Space for Sample Efficient Exploration

Arxiv

0+阅读 · 2022年4月15日

Challenges for Open-domain Targeted Sentiment Analysis

Arxiv

1+阅读 · 2022年4月15日

Multimodality in Meta-Learning: A Comprehensive Survey

Arxiv

37+阅读 · 2021年9月28日

A Survey on Dialogue Systems: Recent Advances and New Frontiers

Arxiv

11+阅读 · 2018年1月11日

VIP会员