计算机视觉的四项基本任务辨析

计算机视觉是使计算机能理解采集设备采集的图像视频的一门学科,目的是让计算机实现人的视觉功能------对客观世界的三维场景的感知、识别和理解。换句话说,要让计算机具备通过二维图像认识三维环境的能力。

目录

三个阶段

视觉层级

基本任务

技术难点


三个阶段

计算机视觉研究图像包括图像处理、图像分析、图像理解三个阶段。

视觉层级

计算机视觉可以划分为初级视觉、中级视觉、高级视觉三个层级:

|------|-------------|
| 初级视觉 | 图像修复、超分辨率重建 |
| 中级视觉 | 图像分割、物体检测 |
| 高级视觉 | 图像描述、动作识别 |

基本任务

计算机视觉包括四项基本任务:分类、定位、检测和分割

  • 分类 :解决**"图像是什么"**的问题,即给定一张图或一段视频,判断图片或视频所属的类别

  • 定位 :解决**"目标在哪里"**的问题,即判断图像中的目标具体在图像的什么位置,位置通常以包围盒的形式表示,通常面向单一或给定数目的目标。

  • 检测: 解决**"哪里有哪些哪种类别的目标"**的问题,即发现图片中的目标并判断目标种类,检测任务面向的图像中出现的目标种类和数目都不定。

  • 分割 :解决**"每个像素属于哪个目标/场景"** 的问题,分为。检测只需要框出每个目标的包围盒,分割则需要进一步判断图像中哪些像素属于哪个目标。分割包括语义分割、实例分割和全景分割,语义分割不区分属于相同类别的不同实例,实例分割则需要区分出哪些像素属于相同类别的不同实例。全景分割可以认为是实例分割和语义分割的结合。

技术难点

|-------|---------------|
| 难点 | 示例 |
| 平面内旋状 | 物品正放、倒放、侧放的检测 |
| 超平面旋转 | 肢体等三维动作的检测 |
| 背景干扰 | 复杂场景下的目标检测 |
| 光照变化 | 图片过曝或图片过暗 |

相关推荐
清辞8531 小时前
Coze从入门到实战---第一、二章
大数据·人工智能·学习·语言模型
质造者1 小时前
LangChain + Ollama + Tavily 实现旅游问答系统
linux·人工智能·python·langchain·rag
追梦人电立电子1 小时前
X、Y电容的分类与选择
人工智能·分类·数据挖掘·追梦人电力电子
美狐美颜SDK开放平台1 小时前
直播APP开发实战:第三方美颜sdk接入步骤与注意事项
人工智能·音视频·美颜sdk·第三方美颜sdk·短视频美颜sdk
yychen_java1 小时前
当算法成为武器:AI泛滥时代的多维危机透视与治理路径
网络·人工智能·ai
TomatoStudy1 小时前
IT职业教育AI落地与实训体系建设复盘——以职坐标模式为例
大数据·人工智能
大模型最新论文速读1 小时前
小红书提出 RedKnot:分头处理 kv 缓存,延时降低 60%效果还提升
论文阅读·人工智能·深度学习·机器学习·缓存·自然语言处理
阿瑞IT1 小时前
AI Agent 工具调用可靠性的工程实践
人工智能
编码者卢布1 小时前
【Azure AI Search】 searchMode=any 和 searchMode=all 有什么区别?
人工智能·python·flask
Samooyou1 小时前
大模型微调(Fine Tuning)
人工智能·python·ai·语言模型