关于Deformable Convolution:自我整理一次可变形卷积

Deformable Conv用得很多,据我预期来说,可变形卷积就是让原来kernel中"定死"的参数变成"可学习的"参数,这样kernel的形状就会变来变去,最终提取出来的feature形状也更加多样

参考文章:CNN卷积神经网络之DCN(Deformable Convolutional Networks、Deformable ConvNets v2)_dcn神经网络-CSDN博客

参考视频:(这个博主值得关注哦) Enzo_Mi的个人空间-Enzo_Mi个人主页-哔哩哔哩视频 (bilibili.com)

(一)使用位置

并不是所有的卷积都一股脑地换成可行变卷积就是好的,在提取到一些语义特征后使用形变卷积效果会更好一点,一般来说是网络靠后的几层。

(二)弊端

因为可学习的参数增加了,所以 参数量会稍微增多 、 运行速度也会略微变慢

(三)其他

等待实践。。。

相关推荐
AI日报派送佬3 小时前
Ultralytics YOLO 模型训练技巧与最佳实践
人工智能·python·深度学习·yolo·机器学习·计算机视觉
一木 之林5 小时前
Dify学习笔记 00 · 总览:56集四模块学习地图(从低代码平台到检索底座)
人工智能·计算机视觉·langchain
田威AI1 天前
图片内文字翻译的规格:输入输出、保真、自动化、时间与费用
前端·计算机视觉
hahaha60161 天前
FPGA+ARM实现AWB的全流程
人工智能·嵌入式硬件·算法·计算机视觉·fpga开发
PascalXie1 天前
免标定视觉伺服综述:严格定义、四级分类与端到端的边界
计算机视觉
ggb喔1 天前
52pojie 的图片工具:为什么无损转换后体积涨了 6 倍、照片方向还是歪的
图像处理·python·算法·计算机视觉·图形渲染·媒体
richard_yuu1 天前
OpenCV 实战第 8 篇:几何测量算子族,从 boundingRect 到亚像素定位
人工智能·opencv·计算机视觉
拜小白1 天前
为什么要在LayoutNet中进行3D 布局优化
计算机视觉
冷雨夜中漫步1 天前
YOLO快速入门——(2)YOLO V26安装与快速入门
图像处理·算法·yolo·计算机视觉
yiyideda1 天前
保单OCR工程实践:PDF/扫描件/纸质拍照三种输入下的字段结构化方案
计算机视觉·pdf·ocr·车险保单识别·保单ocr识别