使用pycharm+opencv进行视频抽帧(可以用来扩充数据集)+ labelimg的使用(数据标准)

一.视频抽帧

1.新创建一个空Pycharm项目文件,命名为streach zhen

注:然后要做一个前期工作 创建opencv环境

(1)我们在这个pycharm项目的终端里面输入下面的命令:

python 复制代码
pip install opencv-python --user -i https://pypi.tuna.tsinghua.edu.cn/simple
pip install opencv-contrib-python --user -i https://pypi.tuna.tsinghua.edu.cn/simple

这里可能会报错:如果你用的是base环境,那么原样输入上面两个命令。如果创建的是虚拟环境,把上面两条语句中的--user去掉。

(2)使用一个测试python文件看看安装好了没有

·创建一个新的python文件,命名为test.py(注:这个截图里面的其他文件夹是后面创建的,可以先不管)

·这个test.py里面复制下面这个语句,看看有没有报错问题。没有就安装好了

python 复制代码
import cv2 as cv

src = cv.imread("D:/desk.jpg")
cv.namedWindow("input image",cv.WINDOW_AUTOSIZE)
cv.imshow("input image",src)
cv.waitKey(0)
cv.destroyAllWindows()
print("hi python")

2.将一个预先找好的mp4文件(这里用的是这个BVN.mp4)复制粘贴进这个文件夹里面

(注:这个截图里面的其他文件夹是后面创建的,可以先不管)

我跟着B站博主做的,这个mp4文件可以在大佬的github里面找到,大家可以自己在里面下载

3.在终端输入:

复制代码
jupyter notebook

网页端会自动打开(如图所示)

4.New一个.ipynb文件 ,打开它(自己照着敲一遍)

注意,在第13行代码的最后,我们把这个mp4里面抽的帧放在了image这个文件夹下面,我跟着博主做的时候,博主用的vscode,会自动生成images这个文件夹,但是我的不行,在jupyter里面运行对于语句之后虽然没有报错,但是发现pycharm项目里面没有新生成一个images文件夹(里面应该存放的是很多抽出来的帧图片)。问了同义千文,发现需要自己在pycharm项目下创建一个images的文件夹,不然它找不到。

咱就是说一整个大成功!

二.使用labelimg

1.在终端输入:

python 复制代码
pip install labelimg
labelimg

会自动打开这个小窗口。爱了爱了!

2.使用事项

右键

快捷键:A 上一张 D下一张 W快速创建框

接下来就是体力活儿了

3.数据调整

在images文件夹里面新建两个文件夹

·train

·val

300-480放到val里面去,其余的放到train里面去

labels文件也同上操作 (注意:class文件不要放进去)

4.把labels和images都放到一个datasets文件夹下面,然后把这个datasets文件夹复制粘贴到我们的yolo项目下面去。这个yolov5-master是在官方github下面下载的,里面的环境配置可以自行搜索怎么配。CSDN上面有很多,我之前的博客里面也有,这里不再赘述。

5.修改data里面的数据集描述文件,我们直接复制一份coco128.yaml,并且重命名为BVN.yaml,然后在里面改参数

6.train.py里面把这里改了

7.运行train.py

又是一个大成功!!

相关推荐
海带紫菜菠萝汤几秒前
本周 AI 观察:嘴上喊着降速,手上全踩油门
人工智能·深度学习·ai·开源·大模型
东风破_11 分钟前
把 Elasticsearch 全文检索讲明白:倒排索引、IK 分词器和 BM25
人工智能
远翔调光芯片^1382879887213 分钟前
ECP5702能芯科技PD取电芯片在市场上的优势有哪些?
开发语言·人工智能·单片机·嵌入式硬件·智能家居
东风破_13 分钟前
从 RAG 到 Agentic RAG:第三步,本地知识不够就去网络搜索
人工智能
桃西西呀18 分钟前
别被"秒回"骗了:推理模型背后那只"吞金兽",吃的是你看不见的预算
人工智能·llm·ai编程
龙亘川1 小时前
AI + 人社新范式:智慧人社系统如何为民生治理数字化难题提供帮助
人工智能·智慧城市·数据可视化·政务
水如烟1 小时前
孤能子视角:蓝星文明篇·市——交换机制的运行化:从偶发交换到日常运行的制度化
人工智能
技灵AI1 小时前
Wan 3.0 API怎么做多参考商品视频?从图片、视频、音频分工到30秒交付
人工智能·prompt·aigc·音视频·wan 3.0
武子康1 小时前
CLAUDE.md 引用 AGENTS.md 后,两边真的读到同一套规则吗?
人工智能·llm·agent
动恰客流统计1 小时前
线下零售数字化浪潮下,客流统计的3个核心发展趋势
大数据·前端·人工智能