BiFPN-YOLO:一种集成双向特征金字塔网络的一阶段目标检测方法(英国爱尔兰2025年联合研究)

**摘要:**目标检测是计算机视觉研究的关键组成部分,能够使系统确定给定场景中物体的位置与类型。YOLOv5是一款现代目标检测模型,它在保留原始YOLO实现优势的同时,完全采用Python语言从零构建。本文提出的BiFPNYOLO模型相较现有YOLOv5系列目标检测模型实现了显著改进:不仅用性能更优的双向特征金字塔网络(BiFPN)取代了传统的路径聚合网络(PANet),需对其原始实现进行复杂适配才能与YOLOv5兼容;还通过对比多种激活函数性能,探索了替代标准Swish激活函数的新方案。该模型在德国交通标志检测基准(GTSDB)上将mAP提升3.1%,在RoboFEI@Home数据集上将平均精度(mAP)较基础YOLOv5模型提升2%;在 MSCOCO 数据集上的表现提升1.1%,在OpenImagesV6数据集的自定义子集上提升2.4%。
YOLOv1至YOLOv8的比较分析,对比了平均精度、参数数量及所使用的激活函数。
神经网络中 FPN (a)、PANet(b)和BiFPN(c)的可视化展示
提出的BiFPN-YOLO架构。每种颜色代表不同的架构模块。
本文总结了Swish、 ACON 、FreLU、Hardswish、LeakyReLU、Mish及Sigmoid激活函数,详细阐述了它们的数学定义及其适用范围。
在 MSCOCO 数据集上,YOLOv5、BiFPN-YOLO和YOLOv7从头训练后的实验结果。
YOLOv5和BiFPN-YOLO在 GTSDB 数据集上从头开始训练后的结果。
当YOLOv5和BiFPN-YOLO在 GTSDB 数据集上采用迁移学习进行训练时的结果
当YOLOv5和BiFPN-YOLO在RoboFEI@Home数据集上采用迁移学习进行训练时的结果。
当YOLOv5和BiFPN-YOLO在RoboFEI@Home数据集上从头开始训练时的结果。
当YOLOv5和BiFPN-YOLO在Open Images V6数据集上从头开始训练时的结果。
当YOLOv5和BiFPN-YOLO在RoboFEI@Home数据集上采用迁移学习进行训练时的结果。

**结论:**本研究对改进当前最先进的YOLOv5目标检测模型的效果进行了深入分析。我们提出了BiFPN-YOLO这一新模型,其核心在于用更复杂的BiFPN颈部结构替换了YOLOv5中的标准PANet。针对BiFPN-YOLO的实验表明,与YOLOv5及当前最先进的单阶段检测器相比,该模型在计算效率和性能方面均取得显著提升;若进一步替换标准Swish激活函数,还能获得额外改进效果。基于四个数据集的实验结果为激活函数的选择提供了可靠依据。本研究进一步推动了 GTSDB 和RoboFEI@Home数据集领域的技术进步。具体建议如下:1. 在追求最高平均精度(mAP)时,BiFPN-YOLO几乎总是优于YOLOv5;2. 转移学习及仅冻结主干网络有助于提升BiFPN-YOLO性能,尤其在训练数据集规模较小的情况下;此外,转移学习还能改善目标定位精度;3. 不推荐仅冻结除最终全连接层外的所有网络层进行迁移学习,因为这会导致模型在精确率、召回率和mAP等可量化指标上大幅下降;4. MSCOCO 仍是预训练BiFPN-YOLO和YOLOv5的首选数据集;5.与YOLOv5相比,BiFPN-YOLO在 MSCOCO 上的平均性能提升了1.1%。6.在精确率、召回率和训练时间方面,BiFPN-YOLO均优于YOLOv7,而YOLOv7的准确率仅略高。

相关推荐
飞哥数智坊6 分钟前
架构图 SKILL 封装好了,顺便做了虾的适配
人工智能
冬奇Lab12 分钟前
Code Agent 解剖(16):AgentTeams——为什么一个 agent 不够用?
人工智能
东风破_20 分钟前
聊天记录越来越长怎么办?从消息数量截断到 Token 截断
人工智能
冬奇Lab21 分钟前
开源项目第204期:LoopX — 长周期 Agent 控制平面,跑在 Codex/Claude Code 之上的状态管理层
人工智能·开源
ZGIAI1 小时前
旧模型下线前,客服 Agent 怎么迁移
人工智能·架构
东风破_1 小时前
程序重启后,AI 为什么把你忘了?从 InMemory 到持久化 Memory
人工智能
ZGIAI1 小时前
客服知识库更新后,怎么批量验收
人工智能·架构
Asize2 小时前
AI 协作开发新范式:我用 SDD 做了个排版 npm 包
前端·人工智能
IT_陈寒4 小时前
用了Proxy才发现以前的JavaScript白写了
前端·人工智能·后端
甲维斯4 小时前
Claude Opus5手搓“NewAPI Plus”首轮成果!
人工智能