技术分享 | 遥感影像中的旋转目标检测系列(一)

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

基于 Transformer 的旋转目标检测框架 D2Q-DETR 

01  背  景   

图 1:遥感影像中的目标检测

与自然影像数据集不同,遥感影像中的目标通常以任意角度出现,如图 1所示。自然影像常用的水平框目标检测方法,在遥感影像上的效果通常不够理想。一方面,细长类目的待检测目标(比如船舶、卡车等),使得水平框检测的后处理很困难(因为相邻目标的水平框的重合度很高)。另一方面,因为目标的角度多变,水平框不可避免引入过多的背景信息。针对这些问题,遥感目标检测更倾向于检测目标的最小外接矩形框,即旋转目标检测。旋转目标检测最近因其在不同场景中的重要应用而受到越来越多的关注,包括航空图像、场景文本和人脸等。特别是在航空图像中,已经提出了许多设计良好的旋转目标检测器,并在大型数据集上(比如 DOTA-V1.0)获得了较好的结果. 与自然图像相比,航拍图像中的物体通常呈现密集分布、大纵横比和任意方向。这些特点使得现有的旋转对象检测器变得复杂。我们的工作重点是简化旋转对象检测,消除对复杂手工组件的需求,包括但不限于基于规则的训练目标分配、旋转 RoI 生成、旋转非最大值抑制 (NMS) 和旋转 RoI 特征提取器。

我们的方法基于 DETR,一个最近提出的使用 Transforemer 的端到端对象检测框架。与我们最相关的工作是 O2DETR,它为 DETR 添加了额外的角度回归,从而用于旋转对象检测。角度的直接回归会导致两个问题:一是角度周期性导致的边界不连续;另一个是角度(以弧度为单位)和目标框尺寸(以像素为单位)之间的单位不匹配。与 O2DETR 直接回归角度不同,我们提出的方案是,为每个旋转框预测一组点,预测的这组点的最小外接矩形框将用来表示待预测的旋转目标。点的学习更加灵活,并且一组点的分布可以反映目标旋转框的角度和框的大小。据我们所知,与直接角度回归相比,我们是第一个将点预测与 Transformer 相结合,并在旋转目标检测方面取得了卓越的性能。

       我们的主要贡献如下:

  • 我们提出一个新型端到端旋转对象检测框架,命名为 DQ-DETR。据我们所知,我们是第一个将点预测与 Transformer 结合起来进行旋转目标检测的工作。

  • 我们提出了一种新颖的动态查询设计,它在不牺牲模型性能的情况下减少了对象查询数量。

  • 我们首次在解码器层将查询特征解耦为分类和回归特征,显著提高了检测性能。

  • 我们提出一种有效的标签重新分配策略以获得更好的性能。

  • 与现有的 NMS-based 和 NMS-free 的旋转对象检测方法相比,我们在具有挑战性的 DOTA-v1.0 和 DOTA-v1.5 数据集上实现了新的 SOTA。COCO 数据集的扩展实验也证明了我们的新设计对通用目标检测的有效性。

遥感图像目标检测研究综述 阅读详情

相关推荐

详解经典旋转目标检测算法RoI Transformer

、引言 1、旋转目标检测检测就是将具有旋转方向的目标检测出来,也就是需要检测目标的中心点、长宽、角度。在俯视图的目标检测中比较常见,如遥感图像目标检测、航拍图像目标检测等。(见下图旋转目标检测,图源论文RoI Transformer ) 2旋转目标检测算法,目前多阶段里面性能较好的是RoI Transformer这个算法,本篇博客将详细分析此算法。 论文《Learning RoI Transformer for Oriented Object Detection in Aerial Images》 开

qq_36561737的博客 2万+

旋转目标检测【1】如何设计深度学习模型

平常的目标检测是平行的矩形框,“方方正正”的;但对于些特殊场景(遥感),需要倾斜的框,才能更好贴近物体,旋转目标检测来啦~常见的水平框参数表达方式为(x,y,w,h),四个参数分别表示水平框中心的横纵坐标、宽度以及高度。常用的YOLOv5也是用这边表示方式的。旋转框参数表示五参数表示法(𝑥,𝑦,ℎ,𝑤,𝜃),它在原来基础上添加多了个角度𝜃,表示框的旋转情况。八参数表示法量(𝑥1,𝑦1,𝑥2,𝑦2,𝑥3,𝑦3,𝑥4,𝑦4),分别表示框的四个顶点。

黎国溥 6097

从零到:基于MMRotate构建遥感旋转目标检测实战指南

本文提供了基于MMRotate框架进行遥感旋转目标检测的完整实战指南。针对遥感图像中目标方向多变的特点,详细阐述了从环境搭建、自定义数据集标注与格式转换、配置文件修改到模型训练、测试与调试的全流程。重点解决了旋转框标注的核心难题,并分享了数据预处理、参数调优及常见问题排查的实用技巧,帮助开发者高效构建自己的旋转目标检测模型。

a1b2c的博客 449

旋转目标检测综述(持续更新中)

文章目录前言(所有检测模型)五、RRPN(倾斜文本)1.概述2.网络结构3.旋转边界框的表达(Rotated Bounding Box Representation)4。旋转的锚点(Rotation Anchors)5.兴趣区域的学习(Learning of Rotated Proposal)6.区域提取网络的优化(Accurate Proposal Refinement)7.RRoI Pooling Layer十、 RSDet(19.12,DOTA上mAP74.1)、SCRDet(ICCV2019)1

qq_45752541的博客 2万+

ICCV2023|遥感旋转目标检测新SOTA来啦!

作者丨李宇轩@知乎(已授权)来源丨https://zhuanlan.zhihu.com/p/614449075编辑丨极市平台Paper:https://arxiv.org/pdf/2303.09030.pdf代码:https://github.com/zcablii/Large-Selective-Kernel-NetworkAbstract最近关于遥感物体检测的研究主要集中在改进旋转包围框的表示...

深度学习技术前沿 2329

目标检测数据集 第121期-基于yolo标注格式的遥感图像舰船旋转目标检测数据集(含免费分享)

然而,传统的水平框目标检测方法在处理舰船目标时存在显著局限:舰船在遥感影像中往往呈现任意角度的朝向,且与港口码头、集装箱堆场等背景紧密贴合,水平框会引入大量背景噪声,导致检测精度下降、虚警率升高。但目前公开的、高质量的遥感舰船旋转目标检测数据集相对稀缺,且部分数据集存在样本量不足、场景单、标注质量参差不齐等问题,难以满足深度学习模型训练和验证的需求。在使用该数据集进行学术研究时,应遵守相关的学术规范,引用该数据集的来源,尊重数据集创作者的劳动成果。,图像与标签文件数量比例为 1680:1681。

深度学习算法工程师,专注于前沿算法研究与实战应用。在这里,我将分享深度学习领域的实战经验、优质数据集资源以及最新论文解读与精度分析,旨在与广大技术爱好者共同探索人工智能的奥秘,助力技术成长与创新。 1252

OpenMMlab_2023顶会论文分享——弱监督有向目标检测

OpenMMlab_2023顶会论文分享——弱监督有向目标检测

weixin_52836217的博客 537

YOLO12遥感影像中的应用:高分辨率卫星图目标检测挑战赛方案

本文介绍了如何在星图GPU平台上键自动化部署YOLO12实时目标检测模型V1.0镜像,实现高效遥感影像分析。该方案针对高分辨率卫星图像中的目标检测挑战,可精准识别如港口船舶、机场飞机等密集小目标,广泛应用于地理信息监测与智慧城市建设领域。

weixin_29859471的博客 223

YOLOv5改进 | 主干网络 | 动态调整目标的感受野的LSKNet【旋转目标检测SOTA】

yolov5改进,yolov5,LSKNet

kay_545 1610

文学会YOLO系列算法(从V3到11)实现遥感图像目标检测

遥感技术的快速发展,特别是在高分辨率遥感图像的获取能力上的显著提升,已经大大拓宽了遥感数据在环境监测、灾害评估、城市规划及军事侦察等领域的应用范围。在这些应用中,遥感目标检测作为项基础而关键的技术,其研究和发展受到了广泛关注。遥感目标检测旨在从遥感图像中自动识别并定位地表特定目标,其挑战在于需要处理大尺寸、高复杂度的图像,并且需要在多变的环境条件下保持高准确率和鲁棒性。随着深度学习技术的快速进步,基于深度学习目标检测算法,尤其是YOLO系列算法,已经成为遥感目标检测领域研究的热点。

qq_63708623的博客 2817

从CNN到Transformer:PyTorch遥感影像多任务实战指南(地物分类、目标检测与语义分割)

本文详细介绍了从CNN到Transformer在PyTorch框架下的遥感影像多任务处理实战指南,涵盖地物分类、目标检测与语义分割三大核心任务。通过对比传统CNN与Transformer模型的优劣,结合代码示例展示混合模型搭建、数据预处理及训练技巧,帮助开发者高效解决遥感影像处理中的实际问题,提升模型性能与部署效率。

weixin_29046611的博客 277

C#环境下OpenVINO部署YOLOv8-OBB旋转目标检测实战

目标检测计算机视觉的基础任务,但常规水平框难以贴合倾斜目标,尤其在工业质检、遥感影像等场景中,检测框冗余面积大、易遮挡相邻目标。旋转目标检测(OBB)通过引入角度维度,以带方向的矩形框实现精准定位,成为解决倾斜目标检测的关键技术。YOLOv8-OBB作为经典算法,将角度预测转化为180个bin的分类问题,有效规避了角度回归的周期性问题。在工程部署中,OpenVINO凭借对Intel CPU的深度优化和轻量级运行时,成为C#上位机实现高性能推理的理想选择。本文以工业视觉为背景,系统讲解在C#环境中使用Ope

weixin_29061465的博客 342

FlyAI-遥感影像场景分类预测经验总结

文章目录数据介绍经验1. 准确率92.55%:SENet、PyTorch1、数据预处理:加权采样2、数据增强:采用随机裁剪,随机旋转,随机翻转,随机擦除3、模型选择:Senet154,够强大的Baseline4、模型优化:标签平滑5、模型集成;没采用此方法,单模型单尺度测试得到的结果经验2. 准确率93.12%:DenseNet,Keras1、预处理-最大最小缩放中心化2、模型选择方面-预训练De...

三岁的博客 2214

优秀博士学位论文分享:复杂场景下高精度有向目标检测的研究

本推文主要介绍上海交通大学杨学博士的研究成果,其博士论文《复杂场景下高精度有向目标检测的研究》荣获了2023年中国计算机学会“博士学位论文激励计划”(原优秀博士学位论文奖)。该论文聚焦研究复杂场景下高精度的有向目标检测算法。

audyxiao001的博客 3663

YOLOv8改进 | 主干网络 | 动态调整目标的感受野的LSKNet【旋转目标检测SOTA】

yolov8,yolov8改进,yolov8_LSKNet

kay_545 1673

从零到:基于PyTorch的YOLOv7-OBB旋转目标检测实战指南

本文详细介绍了基于PyTorch的YOLOv7-OBB旋转目标检测实战指南,涵盖从基础认知到实际部署的全流程。通过解析YOLOv7-OBB的核心改进、环境搭建、模型架构、训练技巧及部署优化,帮助开发者高效实现旋转目标检测,特别适用于遥感影像分析和文档扫描等场景。

weixin_42534103的博客 409

YOLOv8实战:5步搞定遥感影像中的建筑物检测(附完整代码)

本文详细介绍了如何利用YOLOv8模型高效实现遥感影像中的建筑物自动检测。通过5个实战步骤,从环境搭建、数据处理、模型训练到优化部署,提供了完整的代码指南,帮助开发者和GIS从业者快速构建AI驱动的建筑物识别系统,显著提升遥感影像分析效率。

weixin_29230865的博客 548

roLabelImg2yolo:高效旋转目标标注转换工具实战指南

本文详细介绍了roLabelImg2yolo工具,它能高效地将roLabelImg生成的旋转目标标注XML格式,精准转换为YOLO系列算法(如YOLOv5-OBB、YOLOv8-OBB)所需的TXT格式。文章深入解析了转换原理、核心脚本、实战流程及常见问题解决方案,帮助从事遥感、自动驾驶等领域的开发者快速完成数据预处理,将精力集中于模型训练与优化。

lemon的博客 1073

C#部署YOLOv11-OBB旋转目标检测:ONNX Runtime工业级集成实战

目标检测计算机视觉的核心任务,旨在识别图像中物体的位置与类别。其原理通常基于深度神经网络,通过回归或分类来预测边界框。在工业质检、遥感分析等场景中,物体常呈任意角度,传统水平框检测精度不足,旋转框检测技术应运而生。ONNX Runtime作为高性能推理引擎,能有效解决模型跨平台部署的工程化难题,尤其在C#工业上位机软件中,其官方维护、硬件适配性强及内存操作高效等特性,为模型落地提供了稳定保障。本文聚焦YOLOv11-OBB模型,通过封装预处理、推理、后处理全流程,提供了套开箱即用的C#解决方案,助力开发

weixin_28686915的博客 290
上一篇: ICLR2022系列解读之一:基于Transformer的跨域方法CDTrans
下一篇: 技术分享 | 半监督学习介绍
AI Earth地球科学云平台
博客等级 码龄4年 282粉丝 18原创
评论 5
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

AI Earth地球科学云平台

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值