(论文阅读15/100)You Only Look Once: Unified, Real-Time Object Detection

|----|------|----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| 文献阅读笔记 |||
| 简介 | 题目 | You Only Look Once: Unified, Real-Time Object Detection |
| 简介 | 作者 | Joseph Redmon, Santosh Divvala, Ross Girshick, Ali Farhadi |
| 简介 | 原文链接 | https://arxiv.org/pdf/1506.02640.pdf 《You Only Look Once: Unified, Real-Time Object Detection》-CSDN博客 |
| 简介 | 关键词 | Null |
| 简介 | 研究问题 | 目标检测框架问题。 |
| 简介 | 研究方法 | 将detection视为回归问题,仅使用一个neural network同时预测bounding box的位置和类别,因此速度很快。 由于不需提取region proposal,而是直接在整幅图像进行检测,因此YOLOv1可以联系上下文信息和特征,减少将背景检测为物体的错误。 YOLOv1学习到的是目标的泛化表示(generalizable representations),泛化能力非常强,更容易应用于新的领域或输入。 由于不需提取region proposal,则YOLOv1的检测流程很简单: Resize image:将输入图片resize到448x448。 Run ConvNet:使用CNN提取特征,FC层输出分类和回归结果。 Non-max Suppression:非极大值抑制筛选出最终的结果。 |
| 简介 | 研究结论 | 背景上预测假阳性的可能性比较低。 |
| 简介 | 创新不足 | 损失函数设计存在缺陷,会产生更多地定位错误。 对重叠、邻近的物体检测不友好。 测试数据中出现了训练数据中没有的长宽比时,泛化能力低。 |
| 简介 | 额外知识 | DPM(Deformable PartsModel)算法:基于部件的检测方法,对目标的形变具有很强的鲁棒性。 DPM(Deformable Parts Model)--原理(一)_deformable parts models.-CSDN博客 |

相关推荐
森山冶仁9 小时前
AI 原生数据治理技术栈:大模型 + 向量库 + 知识图谱怎么选
人工智能·知识图谱·数据治理
记忆张量MemTensor9 小时前
产品更新|MemOS 现已支持 DeepSeek Harness 长期记忆接入
人工智能·typescript·开源·agent
FII工业富联科技服务10 小时前
WRC 2026技术拆解:从人类示范到真机反馈,机器人“大脑”如何完成训练闭环?
人工智能·机器人·自动化·制造
科里 Coralyx10 小时前
RLHF、InstructGPT、红队测试:从“会生成“到“可交付“
人工智能
桃西西呀10 小时前
TRAE Work实战:我把会议纪要做成了skill
人工智能
武汉星际互动10 小时前
政务AI智能体怎么建?三种模式、三步路径与四个误区
人工智能·政务
MartinYeung511 小时前
Zig:重新定义性能与控制规则的系统级语言
人工智能
catino11 小时前
Prompt详解
人工智能·prompt
敢敢のwings11 小时前
类OpenClaw 网络深度解析:AI Agent 自动化的新范式
运维·人工智能·自动化