C#调用Microsoft.ML.OnnxRuntime和YOLO5模型时的输出数据处理分析

  采用ultralytics网站提供的YOLO5模型进行模型预测时,其模型输出的数据格式为1,84,8400,该格式与YOLOv5官方原生输出的 1, 25200, 85不太一样,其每个维度的含义如下:

  维度1 :输出的结果图片数量,类似BCHW格式中的B;
  维度2 :每个预测框的特征向量长度,可以理解为每个预测结果的内部结构,包括4个边界框坐标值(边界框中心坐标、宽度及高度,未归一化)和基于COCO数据集的80个类别概率;
  维度3:预测框的总数量,即所有特征图上锚框(Anchor)的总和,可以理解为预测结果的总数量。
  基于上述输出数据格式分析,为在原图中标识模型预测结果,需要执行以下步骤:
  1)计算每个预测结果的最高概率类别,针对8400个预测结果,计算每个计算结果中80个类别概率中的最大类型概率,如果该概率大于指定的阈值,则保留该预测结果,同时基于预测结果的边界框坐标值、模型输入尺寸、模型原始尺寸等信息计算预测框在原图中的位置及尺寸;
  2)针对步骤1中筛选的预测结果集合进行非极大值抑制处理,去除目标检测中的冗余重复框。当多个预测框重叠检测同一物体时,它保留置信度最高的框,抑制掉与其重叠度过高(IoU大于阈值)的其他框,确保每个目标只输出一个最准确的检测结果。
  3)在原图中调用OpenCvSharp绘制每个预测结果的预测框及最高概率类别文本。

参考文献:

1https://docs.ultralytics.com/zh/modes/predict

2https://www.cnblogs.com/CrescentWind/p/18676617

相关推荐
PinoLio19 小时前
鲁班猫5-实战篇之虚拟机运行yolov5
yolo·ubuntu
梦想三三2 天前
YOLOv5口罩检测完整实战(二):从现成数据集到训练、评估与摄像头识别
人工智能·yolo·计算机视觉·目标跟踪
探物 AI3 天前
yolo核心组件9:BiFPN 加权双向特征金字塔
yolo
懷淰メ3 天前
【AI赋能】基于PyQt+YOLO+DeepSeek水上漂浮物检测系统(详细介绍)
人工智能·yolo·目标检测·计算机视觉·pyqt·漂浮物·水上漂浮物
FL16238631293 天前
非机动车闯红灯电动摩托车闯红灯检测数据集VOC+YOLO格式1754张3类别
人工智能·yolo·机器学习
星云_byto3 天前
开付费专栏的意见收集
yolo·detr·多模态融合·rgb-d·多模态目标检测·rgb-ir·rgb-t
梦想三三5 天前
YOLOv5 口罩目标检测实战(一):项目整体介绍与数据准备
人工智能·yolo·目标检测
风逸尘_lz6 天前
面试:基于yolov5的头盔检测系统-项目概述(待补充)
人工智能·yolo·目标跟踪
羊羊小栈6 天前
化学生物实验室安全检测分析预警系统(YOLO检测_多模态大模型分析)
人工智能·安全·yolo·毕业设计·大作业
探物 AI6 天前
YOLO 目标检测中的特征是如何流动的
yolo·目标检测·目标跟踪