Gemini写的抠图工具

工具地址(没有打包成软件):https://github.com/hou080146/RailFOD-Dataset-Generator

项目有个需求:检测某区域内有没有特定物品

问题:检测的场景有特殊性,需要通过图像增强造数据集

解决方法:通过抠图把公开数据集中的需要检测的物品抠出来,然后通过图像增强贴到场景中

花了10分钟让Gemini写了个工具,调用Facebook的SAM 2分割模型,使用opencv对物品进行抠图保存

单纯的调用opencv,没有任何UI界面和其他功能。由于我平时又使用Qt开发界面,就想着把他直接做成一个实用工具,又花了几个小时让Gemini修改成PyQt5的工具。

跟anythinglabel一样,直接在点击要抠的物品,绿色遮罩就是抠取的范围。按键S保存并下一张,空格键跳过当前图片

抠图效果

相关推荐
小保CPP1 小时前
OpenCV C++计算多边形的最大内切圆
c++·人工智能·opencv·计算机视觉
m沐沐2 小时前
【计算机视觉】人脸识别三大经典算法:LBPH、Eigenfaces、FisherFaces 原理与实战
图像处理·人工智能·深度学习·opencv·算法·机器学习·计算机视觉
Quz2 小时前
QML 基础按钮:Button、RoundButton 与 DelayButton
qt
Quz2 小时前
QML ToolTip 组件:图标、多行文本与阴影
qt
xcyxiner3 小时前
DicomViewer14(读取图像按固定窗宽窗位显示)
qt
马里马里奥-1 天前
从零搭建AI Agent工具链的技术文章大纲
开发语言·qt
小保CPP1 天前
OpenCV C++基于AI模型的场景文本识别(OCR)
c++·人工智能·opencv·计算机视觉·ocr
Quz1 天前
QML 与 JavaScript 交互方式:内联函数、外部文件、信号槽与工作线程
javascript·qt
Quz1 天前
QML ToolTip 组件:延迟提示与自定义外观
qt
wWYy.1 天前
RPC详解
qt·rpc·php