长尾分布相关论文阅读

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

BBN: Bilateral-Branch Network with Cumulative Learning for Long-Tailed Visual Recognition

原文链接

https://arxiv.org/abs/1912.02413

解决问题:

1 解决自然视觉中的长尾分布问题,属于extremely unbalanced recognition( real-world datasets always have skewed distributions with a long tail)

2 现有的解决长尾分布方法基于 re-balancing,虽然可以提升tailed class的分类准确率,但是会影响到类内的分布情况(类内离散程度变大),也就是 classifier learning效果提升会导致representation learning效果下降

核心思路:

​将representation learning 与 classifier learning独立进行(conventional learning负责前一部分,re-balancing负责后一部分)

​representation learning部分不对原始样本做任何的调整,保证学习到原始数据分布。classifier learning部分对通过一个reversed sampler,对tail data进行建模。两者再通过cumulative learning,通过epoch调整两部分的权重,实现前期关注总体分布,后期关注tail的分布

如何验证re-balancing带来的结果?

​将实验分为两部分,分别学习深度模型的 representation和classifier。在第一阶段,利用CE or re-weighting or re-sampling训练一个分类网络,获得不同的feature extractor部分。feature extractor部分看作representation learning部分,然后再将三个feature extractor 分别利用CE or re-weighting or re-sampling训练最后的分类层(特征提取部分freeze),最后比较结果。发现当 representation learning部分固定住,re-balancing方法要好于CE(这符合传统认知)。但是当固定住classifier,也就是第二阶段对比同样方法训练的模型,feature extractor部分用CE训练的效果最好。

在这里插入图片描述

如上图,可见,固定住classifier,第一阶段CE训练的 representation learning效果最好。论文指出(用CE训练representation部分,用RS训练Classifier部分效果最好)

模型框架

在这里插入图片描述

1 模型backbone:ResNet-32 or 50 。两个branch共享 残差网络的参数权重(除了最后一个残差块 红蓝部分)

2 数据输入:上branch用正常采样;下branch用reverse采样器采样(视为resampling)

3 图中的GAP是global average pooling

4 图中绿色部分利用cumulative learning的策略,根据epoch调整参数a,依此两个branch的关注程度,T是当前epoch,Tmax是总epoch
a = 1 − ( T T m a x ) 2 a = 1 - (\frac{T}{T_{max}})^2 a=1(TmaxT)2
5 模型整体输出为:(Wc , Wr是两个独立的分类器)
z = α W c T f c + ( 1 − α ) W r T f r z = αW_c^T f_c + (1 − α)W_r^T f_r z=αWcTfc+(1α)WrTfr

实验思路

论文在 iNaturalist数据集和Cifar数据集上都进行了实验,具体内容这里不赘述,可参考原文。

个人看法

这篇论文的亮点个人感觉还是在巧妙的设计了对于representation learning 和 classifier learning这两部分是如何互相影响的实验,一定程度上揭开了数据不平衡的内在性质。后续的cumulative learning策略作者也做了实验证明伴随epoch调整对不同部分的attention是有效的,这方面的内容后续也可以借鉴。

论文阅读笔记(visual relation相关)—Visual Relationship Detection with Language Priors Visual Relationship Detection with Language Priors (ECCV 2016) ​ 视觉关系主要是关于图像中,对象与对象之间的各种相互作用。 ​ 视觉关系检测包含检测图像中的对象,定位,并对于两者之间的predicate或者是interaction进行分类。 ​ 但是由于对象的个数本身已经很多,关系的种类也非常多,那么如果按照<subject,p... 阅读详情

相关推荐

论文阅读:《Bag of Tricks for Long-Tailed Visual Recognition with Deep Convolutional Neural Networks》

基于深度卷积神经网络的长尾视觉识别技巧包 摘要 近年来,挑战性长尾分布上的视觉识别技术取得了很大的进展,主要基于各种复杂的范式(如元学习)。除了这些复杂的方法外,对训练程序的简单改进也有一定的贡献。这些改进(也称为技巧)虽小但很有效,例如调整数据分布或丢失函数。然而,不同的技巧可能会相互冲突。如果用户使用这些与长尾相关的技巧不当,可能会导致识别准确度比预期的更差。不幸的是,在文献中还没有关于这些技巧的科学指导。本文首先收集了已有的长尾视觉识别技巧,然后进行了广泛系统的实验,给出了详细的实验指导,并获得了这些

qq_40310050的博客 3674

长尾问题定义及如何解决长尾分布问题

长尾问题(Long Tail Problem)是指在某些数据分布中,少数类别(或事件)出现的频率非常高,而多数类别(或事件)出现的频率非常低。这个现象在很多实际应用中都存在,比如电子商务中的商品销售、自然语言处理中的词频分布、推荐系统中的用户行为等。在长尾分布中,头部(高频部分)占据了大部分的关注和资源,而尾部(低频部分)包含了大量的类别,这些类别虽然单独出现的频率低,但总量却非常大。解决长尾问题的关键在于如何有效地处理这些低频类别,以充分利用长尾部分的数据价值。

bulling的博客 1万+

论文阅读《Deep Long-Tailed Learning: A Survey》综述(一)

Deep Long-Tailed Learning: A Survey 深度长尾学习是视觉识别中最具挑战性的问题之一,旨在从大量遵循长尾类分布的图像中训练出表现良好的深度模型。在过去的十年中,深度学习已经成为学习高质量图像表征的强大识别模型,并在通用视觉识别方面取得了显著的突破。 然而,长尾类不平衡是实际视觉识别任务中的一个常见问题,它往往限制了基于深度网络的识别模型在实际应用中的实用性,因为它们很容易偏向优势类,而在尾部类上表现不佳。 为了解决这个问题,近年来进行了大量的研究,在深度长尾学习领域取得了可喜

qq_40310050的博客 1967

【目标检测】17、BBN:Bilateral-Branch Network

文章目录一、视觉任务数据的特征二、现有文献是怎么解决这类问题的二、本文做法 论文路径:http://www.weixiushen.com/publication/cvpr20_BBN.pdf 代码路径:https://github.com/Megvii-Nanjing/BBN 一、视觉任务数据的特征 机器视觉的代表数据集有很多,如 ImageNet ILSVRC 2012, MS COCO, P.........

呆呆的猫的博客 5165

长尾分布(long-tailed distributions)

如果把不同类别的数据按照出现的频率从高到低进行排序,就会得到一条递减的曲线。在曲线的头部,数据出现的频率很高,随着数据的出现频率逐渐降低,曲线也逐渐下降,缓慢趋近于横轴,看起来就像拖着一条长长的尾巴。

薛铁钢的博客 1万+

数据分布——长尾分布的处理

长尾分布在分类任务中会提到这个名,这是因为长尾分布这个现象问题会导致在训练过程中会出现出错率高的问题,影响了实验结果。这里要说的是,长尾分布是一种现象,有的地方说是一种理论或定律,我感觉这样说不太确切,因为长尾分布并非是一种普遍现象,不能将所有的数据分布或者现象都强加于长尾分布这个概念上。

c___c18的博客 7461

样本不均衡、长尾分布问题的方法整理(文献+代码)

分类任务中的样本不平衡问题,主要是不同类别之间样本数量的不平衡,导致分类器倾向于样本较多的类别,在样本较少的类别上性能较差。 样本不均衡问题常常出现在呈长尾分布的数据中(long tailed data),如下图所示[^longtail]。现实生活中很多数据都类似长尾分布,头部数据类别数据量多,尾部类别数据量少。由于尾部类别(tail classes)数据量少,模型学习到的表征信息不够丰富,导致模型并不能很好的表达尾部类。

人工智能算法与工程实践 1万+

论文阅读:(CVPR 2020 Oral)针对长尾分布识别任务的双边分支网络BBN

论文阅读:(CVPR 2020 Oral)针对长尾分布识别任务的双边分支网络BBN

有问题请直接说问题就好 2069

【弱监督语义分割】SFC: Shared Feature Calibration in Weakly Supervised Semantic Segmentation 论文阅读

图像级弱监督语义分割因其低标注成本而受到越来越多的关注。现有方法主要依赖于类激活映射(Class Activation Mapping, CAM)来生成伪标签,用于训练语义分割模型。在本研究中,我们首次揭示了训练数据中的长尾分布会导致通过分类器权重计算的CAM在头部类别上过度激活,而在尾部类别上激活不足,这主要是由于头部和尾部类别之间共享特征的存在。这种情况会降低伪标签的质量,并进一步影响最终的语义分割性能。为了解决这一问题,我们提出了一种用于CAM生成的。

weixin_44609958的博客 1490

论文阅读】检索增强发展历程及相关文章总结

检索增强相关文章总结:`Knn-LM`->`REALM`->`DPR`->`RAG`->`FID`->`COG`->`GenRead`->`REPLUG`->`Adaptive retrieval`

qq_52852138的博客 2361

9. Enhancing Aspect Term Extraction with Soft Prototypes论文阅读笔记

Enhancing Aspect Term Extraction with Soft By 武汉大学 译文:使用Prototypes软模版SoftProto框架增强属性抽取 EMNLP2020 1. 科学问题 该工作提出基于软模板的 SoftProto 框架来增强方面词抽取任务,旨在解决评论文本中属性词和环境词具有长尾分布(long-tail distribution)的问题。SoftProto 框架几乎可以与所有的序列标注器进行结合。在多个 SemEval 数据集上的实验表明,软模板的引入大幅度地提升了几

薰珞婷紫小亭子的博客 916

论文阅读:Wide & Deep Learning for Recommender Systems

文章目录一、模型引入原因1、线性模型2、DNN结构(非线性)3、Memorization与Generalization二、模型结构1、wide部分2、DNN部分3、Wide&Deep部分三、工程实现1、Data Generation2、Model Training3、Model Serving四、实验结果与总结五、代码实现 一、模型引入原因 在CTR应用中,常用的模型可以分为两类:线性模型...

weixin_45459911的博客 558

论文阅读】【三维场景特殊点云分割】OpenMask3D:Open-Vocabulary 3D Instance Segmentation

NeurIPS2023:OpenMask3D-开放词汇三维场景点云实例分割。

Grey_OnO的博客 1071

论文阅读-1-Rethinking the Value of Labels for Improving Class-Imbalanced Learning

通过标签入手,改善不平衡学习。

怪兽!!!的博客 839

HICO: A Benchmark for Recognizing Human-Object Interactions in Images论文阅读笔记

前言 论文原文地址点这里,这是2015年发表在ICCV上的一篇论文 笔记 本文作者提出了一个用于人和物体交互的新的数据集HICO。这个数据集的特点是有许多常见的物体类别(80种)、基于语义的注释(即将fix the bike和 repair the bike看做同一类别,因为语义上是一个意思)、还仔细标注了在每一张图片中与一个物体类别同时发生的多个交互。 introduction部分作者主要就是阐述(shed light on)了现在有的数据集的一些问题,然后突出自己的数据集的特点,同时经过统计作者

qq_46805191的博客 876

论文阅读:《Overcoming Classifier Imbalance for Long-tail Object Detection with Balanced Group Softmax》

基于深度学习模型的长尾大词汇量对象检测是一项具有挑战性和高要求的任务,但仍未得到充分的研究。 在这项工作中,我们提供了第一个系统的分析,最先进的模型在长尾分布前的表现不佳。 我们发现,现有的检测方法在数据集极其倾斜的情况下无法建模少数类,这可能导致分类器在参数大小方面的不平衡。 由于检测和分类的本质区别,直接将长尾分类模型应用于检测框架并不能解决这一问题。 在本工作中,我们提出了一种新的平衡组 balanced group softmax(BAGS)模块,通过组明智训练来平衡检测框架中的分类器。 它隐式地调

qq_40310050的博客 2522

论文阅读】CTAB-GAN: Effective Table Data Synthesizing

论文阅读】CTAB-GAN: Effective Table Data Synthesizing

weixin_45142381的博客 935

【翻译ver】LesaNet论文阅读(CVPR2019)——医学影像

Holistic and Comprehensive Annotation of Clinically Significant Findings on Diverse CT Images: Learning from Radiology Reports and Label Ontology论文阅读 Contents0 LinksAbstract1.Introduction2.Related Wor...

Sig的博客 2385

论文阅读笔记】VistrongerDet: Stronger Visual Information for Object Detection in VisDroneImages

现有的方法尤其难以在无人机捕获的视频和图像中准确检测目标。在工作中,我们仔细分析了VisDrone DET 2021数据集的特点,发现检测性能低的主要原因是目标微小、尺度跨度大、分布长尾、相似类混淆。为了减轻由此带来的不利影响,我们提出了一种新的检测器VistrongerDet,它具有更强的视觉信息。我们的框架集成了FPN级,ROI级和头部级增强的新组件。得益于整体的增强,VistrongerDet显著提高了检测性能。VistrongerDet是即插即用的,可用于任何基于fpn的两级检测器。

zyq199082的博客 1296
上一篇: K-fold交叉验证(python版)
下一篇: 异常检测(Out-of-distribution detection\ anomaly detection)相关论文阅读
supergxt
博客等级 码龄8年 16粉丝 27原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值