目标检测经典算法的个人理解

one stage

1、RCNN -> Fast-RCNN:RPN部分从用传统的算法 -> 用深度学习网络来实现。

2、Fast-RCNN -> Faster-RCNN:从先选region再求Feature -> 先求Feature再选region。

two stage

1、SSD(2016):VGG做backbone,加入多尺度特征图融合

2、Retinanet(2017):最大的贡献在于用了Focal loss解决了类别不平衡问题。使得一阶段算法的准确度高于了两阶段。

3、YOLO

目标检测算法的主要思路

1、选择候选框

2、提取特征预测候选框的类别及区域优化,所以一个候选框通常有五个参数:box的四个参数和一个类别预测值

3、loss主要由类别损失和BoundingBox的损失组成

4、算法主要的改进思路:①候选框的选取(比例、中心等) ②特征提取的网络 ③损失函数的计算 ④计算损失时采样的规则

相关推荐
顿哥GPT几秒前
2026年8月更新:ChatGPT与Codex深度实践——从Token消耗到AI编程效率优化,开发者如何管理自己的AI用量(GPT-5.6 最新分享)
人工智能·chatgpt·ai编程
DolphinDB智臾科技6 分钟前
告别 TB 级数据搬运:DolphinDB 滤波算法库,重塑物联网数据价值链
物联网·算法
xfan_me9 分钟前
全国今日油价 API-油价查询-油价查询接口
大数据·人工智能·信息可视化
only-qi12 分钟前
美的AI Agent面试题的解析与思考
人工智能·ai·llm·agent·react
谢尔登18 分钟前
分享一些我常用的Skill
java·人工智能·python·actionscript
白拾20 分钟前
【CVPR 2026】CoF:Chain-of-Frames,让视频大模型按帧推理|从多模态视频推理范式视角
人工智能·多模态大模型·视频理解·cvpr 2026·cof 论文分享·链式推理·帧感知推理
星核0penstarry23 分钟前
超越 VLA:NVIDIA 解读|世界动作模型,会是具身智能的未来吗?
人工智能·机器人
科里 Coralyx32 分钟前
评测凭什么成为模型护城河:Agent评测的跨厂机制分析
大数据·人工智能·ai
武子康41 分钟前
VLA 落地先签动作合同:从视觉语言输入到可执行控制指令
人工智能·llm·agent
可编程芯片开发1 小时前
基于双PI控制器结构的六步逆变器供电无刷直流电机调速simulink仿真
算法