计算机视觉

欧特克_Glodon1 小时前
c++·人工智能·opencv·计算机视觉
OpenCV计算机视觉开发入门与实践<二十七>:图像分割概述摘要: 图像分割是图像处理与计算机视觉中的关键技术,旨在将数字图像划分为若干具有特定语义的子区域,是图像分析与理解的重要前提。本文首先概述了图像分割的技术现状与常见方法,随后介绍了其在医学影像、军事制导、遥感气象、交通分析及图像压缩检索等领域的广泛应用,并给出了基于集合论的数学定义。在此基础上,重点对图像分割方法进行了系统分类,详细介绍了基于阈值化、边缘检测、区域生长、神经网络与聚类等五类主流算法的基本原理、优缺点及适用场景,为读者理解与选用图像分割算法提供了参考。
hahaha601613 小时前
图像处理·人工智能·算法·计算机视觉
HLS高层次综合设计技巧--C++类和模板一、C++类的综合和不可综合设计 1.HLS支持对C++的class类的综合; 2.注意的是,HLS是不支持对顶层类的综合的,HLS只支持对顶层函数的综合; 3.关于类的成员函数的综合,需要先将类进行实例化,然后才能综合类的函数 为什么HLS只是支持对顶层函数进行综合呢,而不支持对顶层的类进行综合呢? 因为综合要是资源确定的,函数的返回值,函数的类型都是确定的;但是类只是一个模板, 其需要实例化才能使用,你怎么让类作为顶层呢? 4.类本身是数据类型和方法的封装,但HLS只综合函数,不综合类。 5.HLS综
qq_252941316817 小时前
人工智能·yolo·目标检测·计算机视觉·无人机·羊群识别·羊群
航拍羊群目标检测数据集 | 航拍羊群 智慧畜牧业 动物检测 无人机巡检5010期本数据集专注于无人机航拍视角下的羊群视觉检测,服务于智慧畜牧业、草原生态监测及农业保险定损。数据源于牧场航拍影像,适配羊群计数、放牧管理及草畜平衡评估等应用。
音视频牛哥20 小时前
机器学习·计算机视觉·机器人
拆解人形机器人:从关节、灵巧手到VLA与媒体神经系统如果把人形机器人看成一台“会走路的计算机”,很容易高估大模型的作用,也容易低估关节、传感器、实时控制、能源系统和通信链路的复杂性。
爱吃火鸡面呀20 小时前
人工智能·opencv·计算机视觉
OpenCV 实战:文档扫描与神经风格迁移完整指南OpenCV 作为计算机视觉领域最流行的开源库之一,提供了丰富的图像处理与深度学习推理能力。本文基于两段实战代码,系统讲解两个经典应用场景:一是通过摄像头实时检测并矫正文档,完成透视变换与二值化处理;二是利用 OpenCV 的 DNN 模块加载 PyTorch 训练的风格迁移模型,将普通照片转换为艺术风格图像。通过本文,你将掌握轮廓检测、透视变换、图像预处理以及深度学习模型推理的完整流程。
java1234_小锋20 小时前
人工智能·yolo·机器学习·计算机视觉·yolo26
YOLO26 计算机视觉 - 训练自己的 YOLO26 模型大家好,我是 Java1234 小锋老师。最近正在更新《一天学会 YOLO26 计算机视觉 机器视觉 视频教程》系列专辑,感谢大家的支持与关注。
Hello-FPGA1 天前
人工智能·计算机视觉·fpga开发
量子计算滨松c15550-22up单光子相机与PCIe1004采集卡滨松 ORCA-Quest 2(C15550-22UP)是一款基于 qCMOS 传感器的高性能科学级相机,具备 940 万像素(4096*2304 mono16)全画幅分辨率和极低读出噪声(0.30 e⁻ rms),广泛应用于光片显微镜、单分子荧光成像、超分辨率显微镜及量子技术等前沿领域,尤其是在量子计算领域,该型号qcmos 相机处于统治地位。
梦想的颜色1 天前
人工智能·深度学习·计算机视觉·多模态·aiagent·#vlm·ai工程实战
【AI科普】什么是计算机视觉:硬核科普,它和大 AI 大模型到底是什么关系很多初学者容易混淆概念:AI 就是大语言模型?计算机视觉 = AI 画图?VLM 多模态大模型 = 计算机视觉?
hahaha60161 天前
人工智能·算法·计算机视觉
HLS高层次综合设计技巧--循环merge和循环split一、loop_merge & loop_split 1.loop merge循环合并是有指令的 2.loop split也就是循环拆分 loop fission或者loop distribution这个没有指令,需要开发者手动来进行拆分。 3.循环合并(Loop Merge) 和 循环拆分(Loop Split / Fission) 是两种方向相反的优化策略,分别用于解决不同的问题。
陈年老古董1 天前
人工智能·python·opencv·计算机视觉
OpenCV实战:文档扫描与图像风格迁移最近又捣鼓了两个 OpenCV 的小项目,一个是实时检测摄像头画面中的文档,通过透视变换把它“摆正”并二值化,有点像手机扫描软件;另一个是用训练好的神经网络模型对图片做风格迁移,把普通照片变成卡通或油画效果。代码都不长,但涉及的知识点挺实用,整理出来分享一下。
AI的探索之旅1 天前
人工智能·opencv·计算机视觉
97 个 OpenCV 实例(十四):图像分割,GrabCut 抠图 + inpaint 去水印上一篇让程序「盯住」了运动的东西。这一篇换两个反方向的活——一个把前景从背景里抠出来,一个把划痕水印填回去。图像分割和图像修复,看起来一进一出,其实用的是同一套底层思想:让程序理解「这块像素属于哪」。而 OpenCV 里这两个功能的代表作,就是 GrabCut 和 inpaint。
派大_星1 天前
人工智能·opencv·计算机视觉
OpenCV中的文档扫描与DNN图像处理文档扫描程序首先使用摄像头获取实时画面:这里的0表示使用默认摄像头。为了避免摄像头无法正常打开,需要进行判断:
格林威2 天前
开发语言·人工智能·数码相机·计算机视觉·c#·视觉检测·工业相机
C# 相机Burst模式图像采集:使用相机内存配合OpenCvSharp和Halcon实现短时间的高速采集的方法做飞拍项目的时候,经常碰到一种情况:产品一瞬间过去了,相机拍到了,但千兆网带宽不够,图像传不出来,下一帧又来了,直接丢帧。后来换了带Burst模式的相机,问题才解决。
AI智图坊2 天前
大数据·人工智能·计算机视觉·ai作画·aigc·ai写作
甩手图省事的技术原理:如何用“商品锁定”机制解决AI作图的一致性难题提示:本文仅作为电商平台功能操作与运营技巧之教学演示,旨在帮助卖家优化日常运营效率。文中所有内容均基于平台公开功能及合规业务流程,不构成任何形式的商业投资建议,仅供同行学习与交流参考。
TAN-90°-2 天前
人工智能·深度学习·神经网络·机器学习·计算机视觉·cnn·机器翻译
Deep Learning for Computer Vision——Attention and Transformers1. 传统 Seq2Seq 模型的瓶颈 在传统的编码器-解码器(RNN)架构中,所有输入序列的信息都被压缩成最后一个隐藏状态向量 C,然后传给解码器。
OpenBayes2 天前
人工智能·深度学习·计算机视觉·自然语言处理·语音识别·多模态大模型
Qwen3.8-27B-FP8 降低大模型部署门槛,开启高效多模态智能体验;MiniMax H3-1K 发布千段视频测试数据集,全面评估 AI 视频生成能力公共资源速递6 个公共数据集:* RSNA Knee MRI 膝关节 3D 异常数据集* MiniMax H3-1K 模型图像视频测试数据集
梦想的颜色2 天前
人工智能·机器学习·计算机视觉·aigc·comfyui·ai视频·图生视频
ComfyUI 深度硬核科普:节点式 AI 生成框架完整实战(安装、原理、使用场景、避坑)2026 年,不管是 AI 绘画、AI 漫剧短剧、图生视频、Flux 图像生成,ComfyUI 已经成为专业玩家、独立开发者事实上的标准工具CSDN博...。很多人接触 SD 先使用 AUTOMATIC1111‑WebUI,表单式点按钮,开箱即用,但遇到复杂流水线、角色一致性、批量生成、AI 视频时处处受限。
动物园猫2 天前
人工智能·目标检测·计算机视觉
草莓成熟度目标检测数据集:3类别、2,000张图像 | 目标检测通过网盘分享的文件:草莓成熟度检测数据集 链接: https://pan.baidu.com/s/1WAfTb-SM0Jov7QQ1gFPXAw?pwd=tmwd 提取码: tmwd
AI浩3 天前
人工智能·计算机视觉·自然语言处理
关于 Qwen3.8-Next 架构的设计:评估、效率与训练稳定性我们介绍了 Qwen3.8-Flash-Next 的架构及其消融实验。这是一个稀疏混合专家(MoE)模型,拥有 1250 亿(125B)总参数,每个 token 激活 60 亿(6B)参数,并额外包含 510 亿(51B)参数的 n-gram 嵌入表,这些表被卸载到加速器(accelerator)之外。在 14 个预训练基准测试中,该模型在 8 个测试中领先于其 397B-A17B 的前代模型,在其余测试中落后幅度不超过 2.6 个百分点,而其激活参数量仅为前代的 1/31/31/3,训练 token 数
jay神3 天前
人工智能·深度学习·yolo·机器学习·计算机视觉
一文讲清楚YOLOv26模型最近有人问:"YOLOv26出来了?跟v11啥关系?要不要立刻换?"每次看到这种问题,我想回一句:先把v11用明白再说。