论文阅读——Large Selective Kernel Network for Remote Sensing Object Detection

目录

基本信息

期刊 CVPR
年份 2023
论文地址 https://arxiv.org/pdf/2303.09030.pdf
代码地址 https://github.com/zcablii/LSKNet

标题

遥感目标检测的大选择核网络

目前存在的问题

相对较少的工作考虑到强大的先验知识存在于遥感图像。航空图像通常是用高分辨率的鸟瞰图拍摄的。特别是,航拍图像中的大多数物体可能体积较小,仅从它们的外观很难识别。相反,这些物体的成功识别往往依赖于它们的上下文,因为周围的环境可以提供关于它们的形状、方向和其他特征的有价值的线索。

  1. 遥感图像中目标的精确检测往往需要广泛的上下文信息。
  2. 不同对象类型所需的上下文信息的范围是非常不同的。

改进

大核卷积

卷积核大小和膨大率的增加保证了感受野的快速扩展。我们设置了膨胀率的上界,以保证膨胀卷积不会在特征图之间引入间隙。例如,我们可以将一个大的内核分解为2或3个深度卷积,如表2所示,它们的理论感受野分别为23和29。

优点:

  1. 它显式地生成多个具有各种大型接受域的特性,这使得以后的内核选择更加容易。
  2. 顺序分解比简单地应用单个更大的内核更有效。我们的分解比标准的大卷积核大大减少了参数的数量

空间核选择

在不同尺度上从大卷积核中空间选择特征映射

首先,我们将不同感受野范围的不同核的特征进行串联,然后采用基于通道的平均和最大池化方法有效地提取空间关系,将空间融合的特征进行串联,并使用卷积层将融合的特征(2通道)转换为N个空间注意图,对于每个空间注意图̂SAi,使用一个sigmoid激活函数,对分解后的每个大核分别获得单个空间选择掩码,将分解后的大核序列中的特征按其对应的空间选择掩模加权,再经卷积层融合得到注意特征S

网络结构


另一个写的好的参考

网址

相关推荐
AI模块工坊4 分钟前
CVPR 即插即用 | 当RetNet遇见ViT:一场来自曼哈顿的注意力革命,中科院刷新SOTA性能榜!
人工智能·深度学习·计算机视觉·transformer
m0_6501082433 分钟前
Gemini 2.5:重塑多模态 AI 边界的全面解读
论文阅读·人工智能·多模态大模型·gemini 2.5·跨模态融合
wuk99841 分钟前
基于Matlab的彩色图像特征提取实现
人工智能·计算机视觉·matlab
GEO_NEWS1 小时前
2025下半年GEO服务商技术革命:万数科技以AI全链路优化定义行业标杆
人工智能
说私域1 小时前
智能名片链动2+1模式S2B2C商城小程序:构建私域生态“留”量时代的新引擎
大数据·人工智能·小程序
说私域1 小时前
基于开源AI大模型与AI智能名片S2B2C商城小程序的直播简介引流策略研究——以B站直播为例
人工智能·小程序
金紫火1 小时前
AiPPT 新功能体验:从“一键生成”到更智能的演示制作
人工智能·ppt
Dev7z1 小时前
基于计算机视觉与机器学习的课堂坐姿智能监测与预警系统
人工智能·机器学习·计算机视觉
水如烟1 小时前
孤能子视角:“多劳多得”原则在知识经济时代的失效危机分析
人工智能
钟屿1 小时前
Back to Basics: Let Denoising Generative Models Denoise 论文阅读学习
论文阅读·人工智能·笔记·学习·计算机视觉