无人机低空视角:针对人群密集场景的检测、跟踪和计数技术

无人机低空视角:针对人群密集场景的检测、跟踪和计数技术

DroneCrowd

Paper

无人机在人群中的检测、跟踪和计数:基准研究

简介

本文提出了一种时空多尺度注意力网络(STANet),用于解决由无人机捕捉的视频剪辑中的密集人群的密度图估计、定位和跟踪问题,涵盖了各种人群密度、视角和飞行高度。我们的STANet方法通过聚合顺序帧中的多尺度特征图来利用时间一致性,然后同时预测密度图、定位目标并在人群中关联它们。我们设计了一个由密度图损失、定位损失和关联损失三个项组成的多任务损失函数,并采用逐步应用注意力模块的粗到细过程,以强化网络对判别性时空特征的利用,以提高性能。整个网络以端到端的方式进行训练。在情景中使用非最大抑制和最小代价流框架生成目标的轨迹。由于现有的人群计数数据集主要关注于静态摄像机中的人群计数,而不是无人机上的密度图估计、计数和跟踪,因此我们收集了一个新的大规模基于无人机的数据集,称为DroneCrowd,包括112个视频剪辑,共33600个高分辨率帧(即1920x1080),捕捉了70个不同情景。通过大量的努力,我们的数据集提供了20800个人的轨迹,480万个头部标注以及序列中的多个视频级属性。我们在两个具有挑战性的公共数据集(上海科技和UCF-QNRF)以及我们的DroneCrowd上进行了广泛的实验证明STANet在性能上优于现有技术水平。

数据集

ECCV2020挑战

VisDrone 2020人群计数挑战要求参与算法对每个帧中的人数进行计数。挑战将提供112个具有挑战性的序列,包括82个用于训练的视频序列(总共2420帧)和30个用于测试的序列(总共900帧),可在下载页面上获得。我们在每个视频帧中用点手动标注人物。

DroneCrowd(1.03 GB):百度云(提取码:h0j8)| 谷歌云

DroneCrowd(完整版)

这个完整版本包括112个视频剪辑,共33600个高分辨率帧(即1920x1080),捕捉了70个不同的场景。通过大量的努力,我们的数据集提供了20800个人的轨迹,480万个头部标注以及序列中的多个视频级属性。

DroneCrowd 百度云(提取码:ml1u)| 谷歌云

相关推荐
jndingxin11 分钟前
OpenCV CUDA模块中矩阵操作------归一化与变换操作
人工智能·opencv
ZStack开发者社区16 分钟前
云轴科技ZStack官网上线Support AI,智能助手助力高效技术支持
人工智能·科技
每天都要写算法(努力版)18 分钟前
【神经网络与深度学习】通俗易懂的介绍非凸优化问题、梯度消失、梯度爆炸、模型的收敛、模型的发散
人工智能·深度学习·神经网络
Blossom.11821 分钟前
Web3.0:互联网的去中心化未来
人工智能·驱动开发·深度学习·web3·去中心化·区块链·交互
kyle~22 分钟前
计算机视觉---目标检测(Object Detecting)概览
人工智能·目标检测·计算机视觉
hao_wujing29 分钟前
YOLOv8在单目向下多车辆目标检测中的应用
人工智能·yolo·目标检测
王学政238 分钟前
LlamaIndex 第九篇 Indexing索引
人工智能·python
白熊1881 小时前
【计算机视觉】OpenCV实战项目:基于OpenCV的车牌识别系统深度解析
人工智能·opencv·计算机视觉
IT古董2 小时前
【漫话机器学习系列】261.工具变量(Instrumental Variables)
人工智能·机器学习
小王格子2 小时前
AI 编程革命:腾讯云 CodeBuddy 如何重塑开发效率?
人工智能·云计算·腾讯云·codebuddy·craft