计算机视觉学习(一)

1.什么是计算机视觉

2.计算机视觉的目标是什么

跨越语义鸿沟建立像素到语义的映射

左边是我们人看到的图像,而右边是机器看到的

计算机就是要从很多的像素里面去提取信息得到结论(跨越语义鸿沟->要解决的问题)

3.人类对图像的认识

人类视觉具有高效性,可以快速分辨图像内容,但是人类又具有"运动视盲",也就是图像里面不重要的东西发生变化,不仔细的话可能注意不到。人类认识图像是使用图片的背景,上下文去理解内容的。

从三维信息和语义信息对图像内容进行提取。

4.我的学习内容

聚焦于图像分类任务

相关推荐
冬奇Lab15 分钟前
每日一个开源项目(第140篇):AgentScope 2.0 - 阿里开源的生产级 Agent 框架
人工智能·开源·agent
冬奇Lab26 分钟前
Skill 系列(04):Skill 指标体系——L1/L2/L3 三层监控,让质量下降有据可查
人工智能·开源·llm
IT_陈寒1 小时前
Vite的静态资源打包让我熬夜到三点,这坑千万别跳
前端·人工智能·后端
玩转AI不是事2 小时前
用IndexedDB做AI对话离线缓存实战
人工智能
Asize3 小时前
多模态生图:从 Vite 工程化到前端调用 Qwen Image
javascript·人工智能·后端
MobotStone3 小时前
AI项目越多,为什么越容易失控
人工智能·aigc
十有八七3 小时前
AI时代的置身X内
前端·人工智能
Lkstar3 小时前
A2A协议深度解析|Agent2Agent通信标准,智能体互联网的"HTTP"
人工智能·llm
百度Geek说3 小时前
当代码越来越便宜,什么在变贵?
人工智能
橘子星3 小时前
LLM 无状态架构实践:从原理到代码落地
前端·javascript·人工智能