labelme2coco.py 脚本增强

前言

最近在做一个实例分割的项目,用使用 Segment anything 的脚本先处理一遍图片,然后用labelme人工审核和调整。(labelme 新版本已经加入了 Segment anything,可以AI 抠图,可惜用的是onnxruntime,于是我折腾一番改成了onnxruntime-gpu。最后,个人感觉用cuda扣的比cpu好。)

扣完图按labelme项目中Readme.md指导的,接着生成coco数据集格式的数据集。结果,发现原脚本功能不能满足我的需求:

  • 它不划分测试集和训练集,coco2017是分train2017和val2017,不划分就得改训练脚本。
  • Segment anything 抠图时有些粘连部分没处理好,人工检查没发现,转化时生成的Visualization图片能更好的发现这些,于是需要更新,原脚本没有更新功能,只能从头开始生成全部信息。
  • 工业项目的像素不像coco数据集那么低,训练时要均衡显存和分割效果,要进行一定的缩放。当然可以放在训练前做预处理(既要reszie图片又要resize boxes 和 masks),但是你会发现gpu工作效率下降(gpu在等待cpu处理)。

增强

新加入参数

python 复制代码
    parser.add_argument("--split_rate", help="val file rate", default=0.1)
    parser.add_argument("--scale_rate", help="val file rate", type=float, default=1.0)
    parser.add_argument("--update_dir", help="update input annotated directory,"
                                             "It will check json with input_dir. If changed generate new",
                        type=str, default=None)
  • split_rate 训练集测试集分割比例
  • scale_rate 缩放比例(实现方式是长宽乘以浮点数后强转int,不是四舍五入)
  • update_dir 指定一个annotations目录(也就是新版本的json目录),比对老目录的json,改变的重新生成并覆盖老目录。

划分数据集

分割数据集实现:

python 复制代码
    # 划分 train 和 val
    split_rate = args.split_rate
    indices = list(range(len(label_files)))
    random.shuffle(indices)
    train_size = int((1.0 - split_rate) * len(label_files))
    train_indices = indices[:train_size]
    val_indices = indices[train_size:]

这就是一个随机实现,主要差别是后面,划分后其实是2个非常独立的任务,放到2个进程去加速生成。

python 复制代码
    print('启动2个进程分别执行')
    pool = multiprocessing.Pool()
    pool.apply_async(gen_coco_dateset, args=(
        train_indices, label_files,
        train_path, copy.deepcopy(data),
        class_name_to_id, train_ann_file,
        args.noviz, train_visual_path, args.scale_rate
    ))
    pool.apply_async(gen_coco_dateset, args=(
        val_indices, label_files,
        val_path, copy.deepcopy(data),
        class_name_to_id, val_ann_file,
        args.noviz, val_visual_path, args.scale_rate
    ))
    pool.close()
    pool.join()
    print('所有进程执行完毕')

更新

更新主要流程:

  1. 遍历更新文件目录,区别新增和更新(新增我没有实现)
  2. 判断是否需要更新
  3. 判断在训练集更新还是验证集更新
  4. 最后处理完coco集的json后,覆盖老目录的json文件

更新时最主要要调整的是,原来最后生成单个json文件的 annotations 。

处理时

python 复制代码
# 删除所有 annotations 中关于此图的所有标记信息
data['annotations'] = [item for item in data['annotations'] if item['image_id'] != image_id]

最后要写入时,重新整理

python 复制代码
# 重新排序 data['annotations']
for i, item in enumerate(train_data['annotations']):
	item['id'] = i
for i, item in enumerate(val_data['annotations']):
	item['id'] = i

完整脚本

我fork的labelme项目原labelme2coco.py同级labeme2coco_v2.py

解释一番是希望,能读者能修改我的脚本来满足自己的需求。

相关推荐
kobesdu7 分钟前
从零推导FAST-LIO的观测雅可比矩阵
人工智能·算法·矩阵
u01030552712 分钟前
使用BufferedReader读取控制台输入
人工智能·1024程序员节
测试开发技术19 分钟前
AI 测试提效 | 告别手工写脚本,分享我的 Playwright + Skill 批量生成 UI 自动化脚本方案
自动化测试·人工智能·ui·自动化·agent·skill·ai测试
乐思智能科技有限公司32 分钟前
PLECS软件学习使用(二)直流电机基本系统模型
人工智能·算法·机器学习·面试·职场和发展
极连AI33 分钟前
极连AI平台解读、Codex5.6仅需0.01倍率,无需Token焦虑,极速响应
人工智能·gpt·chatgpt·aigc·ai编程·ai写作·gpu算力
MartinYeung539 分钟前
[论文学习]PACT:溯源感知能力合约——面向智能体安全的参数级溯源
人工智能·学习·安全
带娃的IT创业者42 分钟前
Inkling:当开源模型开始思考“如何思考”
人工智能·开源·大语言模型·多模态·moe·开源模型·inkling
远航计算机1 小时前
职业技能培训机构如何利用QClaw+Skills做豆包GEO:知识库搭建×内容创作×效果监测的完整实操手册
大数据·人工智能·自动化·aigc·火山引擎
旋生万物1 小时前
电磁力 = 螺旋联络的 90° 旋转?麦克斯韦方程组的几何重构
人工智能·python·算法·机器学习·copilot·世界模型·物理ai
Vince的修炼之路1 小时前
防 Prompt 注入安全技术深度分析
人工智能·安全