代码复现:遥感旋转目标检测(可训练自己的数据集)

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

follow了上交博士大佬yangxue的两个方法,这篇仅记录复现过程中碰到的问题,具体论文的介绍就不写了,大佬自己的知乎已经写得非常详细了。

SCRDet:https://zhuanlan.zhihu.com/p/107400817

CSL:https://zhuanlan.zhihu.com/p/111493759

复现的第一个方法:https://github.com/DetectionTeamUCAS/R2CNN-Plus-Plus_Tensorflow

在Ubuntu16.04下

1、tensorflow >= 1.2
2、cuda8.0
3、python2.7 (anaconda2 recommend)
4、opencv(cv2)
5、tfplot

实测tensorflow-gpu==1.2和1.4都可以使用,cuda8需要本地编译安装,anaconda3下创建python2.7环境即可

实际安装tf的时候,conda没办法直接安装这么低版本的tensorflow-gpu,于是从pypi下载了wheel本地安装,其他一些依赖包会自动安装。

pip install tensorflow_gpu-1.4.0-cp27-cp27mu-manylinux1_x86_64.wheel

另外需要注意的是,这个版本的tf配

旋转目标检测mmrotate v0.3.1 训练DOTA数据集(二) 阅读详情

相关推荐

技术分享 | 遥感影像中的旋转目标检测系列()

基于 Transformer 的旋转目标检测框架 D2Q-DETR

AIEarth的博客 3438

旋转目标检测【1】如何设计深度学习模型

平常的目标检测是平行的矩形框,“方方正正”的;但对于一些特殊场景(遥感),需要倾斜的框,才能更好贴近物体,旋转目标检测来啦~常见的水平框参数表达方式为(x,y,w,h),四个参数分别表示水平框中心的横纵坐标、宽度以及高度。常用的YOLOv5也是用这边表示方式的。旋转框参数表示五参数表示法(𝑥,𝑦,ℎ,𝑤,𝜃),它在原来基础上添加多了一个角度𝜃,表示框的旋转情况。八参数表示法量(𝑥1,𝑦1,𝑥2,𝑦2,𝑥3,𝑦3,𝑥4,𝑦4),分别表示框的四个顶点。

黎国溥 6097

【前沿 热点 顶会】CVPR 2025:从开放词汇分割到轻量化Mamba,解锁遥感与多模态视觉新范式

本文探讨了CVPR 2025在遥感与多模态视觉领域的最新突破,包括开放词汇分割技术SegEarth-OV的零样本革命、弱监督旋转目标检测方案RSAR、多模态Mamba在目标重识别中的应用,以及轻量化视觉MambaMobileMamba的端侧部署优势。这些创新技术显著提升了目标检测、分割和重识别的精度与效率,为遥感图像分析和多模态视觉任务提供了新范式。

weixin_27303545的博客 332

针对遥感目标检测(小目标、旋转框、密集目标)的论文整理

文献整理 文章目录文献整理A Multi-Feature Fusion-Based Change Detection Method for Remote Sensing Images内容摘要A Survey on Vision Transformer内容摘要Aerial Target Detection Based on the Improved YOLOv3 Algorithm内容摘要Aircraft Rotated Boxes Detection Method Based on YOLOv5内容摘要Ai

weixin_44159697的博客 9228

ICCV2023|遥感旋转目标检测新SOTA来啦!

作者丨李宇轩@知乎(已授权)来源丨https://zhuanlan.zhihu.com/p/614449075编辑丨极市平台Paper:https://arxiv.org/pdf/2303.09030.pdf代码:https://github.com/zcablii/Large-Selective-Kernel-NetworkAbstract最近关于遥感物体检测的研究主要集中在改进旋转包围框的表示...

深度学习技术前沿 2329

YOLO目标检测保姆级教程:从环境配置到模型部署全流程实战

目标检测是计算机视觉的核心任务,旨在识别图像中物体的类别并定位其位置。其核心原理是通过算法在图像中生成边界框并进行分类。这项技术的价值在于为机器提供了“看懂”世界的能力,是实现环境感知和智能决策的基础。在众多技术方案中,YOLO(You Only Look Once)以其独特的单阶段、端到端设计脱颖而出,将检测任务重构为回归问题,实现了速度与精度的平衡,成为实时检测领域的标杆。从自动驾驶的车辆识别到工业质检的缺陷定位,YOLO的应用场景极为广泛。本文聚焦于YOLOv8这一生态活跃的版本,提供从零开始的完整实

weixin_34326558的博客 387

自监督学习如何提升视觉任务性能:检测、分割与异常检测实战指南

自监督学习(SSL)是一种无需人工标注即可从原始图像中学习通用视觉表征的前沿范式,其核心原理是通过设计伪任务(如图像拼图、掩码重建、对比预测)驱动模型挖掘图像内在结构与语义一致性。相比传统监督预训练,SSL能显著提升特征泛化性、小样本适应速度和跨域鲁棒性,尤其在标注稀缺场景下展现出不可替代的技术价值。在目标检测、语义分割、异常检测等密集预测类任务中,SSL可带来3%~12%的mAP或mIoU提升;而在分类与生成任务中收益有限。本文聚焦工业质检、遥感解译与医疗影像等真实落地场景,结合DINO、MAE、SimM

alexhill2009的博客 416

最新YOLO实现的舰船检测与识别实时检测平台(Flask+SocketIO+HTML/CSS/JS)

面向港口与近海巡检,构建基于Flask+Flask-SocketIO的舰船检测与识别实时平台,前端HTML/CSS/JS,支持图片、视频与浏览器摄像头输入,提供双画面对比、进度控制、CSV导出、带框结果一键下载与SQLite入库;登录/注册可跳过,会话安全可控。平台可在线进行模型选择与权重上传,统一集成YOLOv5–YOLOv12八种实现,比较mAP、F1、PR与训练曲线,并支持阈值与IoU调节及类别筛选。系统兼顾实时性与可追溯,适配边缘部署与团队复现;提供数据与代码下载链接以便快速复用与扩展。

逗逗班学Python 421

AI论文工程化落地的三重过滤与实战指南

人工智能模型研发中,学术论文如何转化为可部署、可复用、可度量的工业级能力?这涉及从基础概念(如自监督学习、元学习、图神经网络)出发,理解其核心原理对数据效率、泛化性与模块化设计的支撑作用;技术价值体现在降低标注依赖、提升小样本适应性、增强边缘部署可行性等关键工程指标;典型应用场景覆盖医疗影像分割、工业缺陷检测、卫星遥感分析及金融风控建模;而本文聚焦于真实世界约束下的论文筛选逻辑——以数据/计算/部署三重过滤为轴心,结合10篇高价值论文的接口解耦、长尾验证与开源审计实践,提供一套面向AI工程师的即插即用型论文

cuikuangru5755的博客 401

ViT视觉Transformer原理与实战:从词元设计到范式迁移

视觉Transformer(ViT)是一种将图像建模为序列的新型视觉表征方法,其核心在于摒弃卷积归纳偏置,转而通过patch embedding、位置编码与[CLS] token构建数据驱动的空间语义理解机制。它并非简单移植NLP中的Transformer,而是重新定义了图像的‘词元化’协议与空间关系建模方式,具备强泛化性但高度依赖大规模预训练数据。技术价值体现在对纹理、结构、长程依赖的统一建模能力,广泛应用于图像分类、医学影像分析、遥感解译及多模态理解等场景。本文深入剖析ViT中patch embeddi

weixin_34357887的博客 375

红外与可见光图像融合:技术与应用研究进展及挑战

本文系统综述了红外与可见光图像融合(IVIF)技术的研究进展与工程实践。针对现有综述难以指导算法落地的问题,提出"接口-注意力-对齐"三维分析体系,对传统空间域/变换域方法和深度学习范式(生成式、判别式、多任务、Transformer等)进行系统归类。创新性地建立融合效果-任务性能-设备限制的关联评测框架,结合2025年前沿成果分析保真度、鲁棒性与效率的权衡关系。提出包含任务精度(AP/mIoU)、推理时延、内存占用的完整评测方案,填补了视频时序一致性、鲁棒性评测等四大研究空白,并给出面向实际应用的选型清单

毕竟是Shy哥 452

视觉特征-自监督-同源不同crop视图一致性【2025-08】:DINOv3【DINOv2+Gram损失=DINO损失+(iBOT损失+Gram损失)+KoLeo正则化损失】

自监督学习有望消除手动数据标注的必要性,从而使模型能够轻松处理大规模数据集以及更复杂的架构。由于无需针对特定任务或领域进行定制,这种训练方式能够利用单一算法从各种来源获取视觉表征,这些来源包括自然图像和航空图像等。本技术报告介绍了 DINOv3,它通过简单而有效的策略,为实现这一目标迈出了重要一步。首先,我们通过精心设计数据准备流程并进行优化,从而提升数据集与模型规模的扩展能力;其次,我们提出了一种名为“Gram 锚定”的新方法,该方法有效解决了在长时间训练过程中特征图质量会下降这一长期存在的难题。

u013250861的博客 222

旋转目标检测-环境配置-数据集制作

旋转目标检测:环境配置 - 数据集制作 - 开始训练

m0_56247038的博客 2217

详解Single-Shot Alignment Network (S2A-Net) ,详解AlignConv,基于遥感图像的特征对齐旋转目标检测

Single-Shot Alignment Network (S2A-Net)是单阶段的目标检测器,包含FAM和ODM。FAM(特征对齐模块)使用ARN产生高质量的锚点,使用AlignConv根据对应的锚框将特征对齐,该网络在特征图中每一个位置只使用一个方形的锚点,然后ARN将该锚点改进为高质量的旋转锚点。接着AlignConv对齐卷积层根据相应锚点的形状、大小和方向将特征排列起来。ODM使用ARF将方向信息编码,提供对方向敏感的特征,接着通过池化对方向敏感的特征提取出方向不变的特征,最后将特征分别输入回归

qq_44343213的博客 3379

旋转目标检测训练自己数据集+问题汇总

复现junjieliang大佬的旋转目标检测代码,将自己遇到的问题全部记录下来,包括数据集制作,训练与部署检测。

m0_46749624的博客 1万+

遥感目标检测(2)--SCRDet

SCR-Det论文的概述、提出的三个挑战、网络架构中SF-Net、MDA-Net、Rotation Branch的流程与参数设定,损失函数,对比实验与消融实验。

NPU 研0 1390

centos7 安装R语言遇到的各种坑

R语言运用于数据分析挖掘方面,并且可以运行于mac、windows、linux,但由于linux自身自带的软件包缺失,会导致在安装过程中出现多种问题,耗费大量的时间在安装上。同时网上也没有比较完善的问题解决集锦。因此,写这篇文章希望对R语言在linux上的安装有一些帮助。

wjxydzxxyy的专栏 2万+

旋转目标检测】使用PaddleDetection训练自定义数据集:一、环境依赖安装

旋转目标检测】使用PaddleDetection训练自定义数据集:一、环境依赖安装

weixin_45921929的博客 1667

遥感领域旋转目标检测OBB记录

首先,请允许我说明一下,笔者也是一名目标检测的小白(研一的小萌新)。前些日子,我敬爱的导师让我根据自己理解总结一下目前自己对于遥感领域目标检测相关的知识,于是便有了以下内容。如果你恰好读到这篇文章,发现文章有问题或者你有自己的见解,欢迎留言! ------------------------------------------------------------------------------------------------------------------------------- ..

weixin_40493382的博客 7131
上一篇: opencv画旋转框(坐标对应关系)
下一篇: CVPR2017: Densecap复现记录
Forizon
博客等级 码龄10年 600粉丝 139原创
评论 6
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值