计算机视觉学习(一)

1.什么是计算机视觉

2.计算机视觉的目标是什么

跨越语义鸿沟建立像素到语义的映射

左边是我们人看到的图像,而右边是机器看到的

计算机就是要从很多的像素里面去提取信息得到结论(跨越语义鸿沟->要解决的问题)

3.人类对图像的认识

人类视觉具有高效性,可以快速分辨图像内容,但是人类又具有"运动视盲",也就是图像里面不重要的东西发生变化,不仔细的话可能注意不到。人类认识图像是使用图片的背景,上下文去理解内容的。

从三维信息和语义信息对图像内容进行提取。

4.我的学习内容

聚焦于图像分类任务

相关推荐
min(a,b)8 分钟前
学习第10天:日志、测试、配置与容器化部署
学习
xqqxqxxq9 分钟前
AI Agent学习:用户记忆系统(李博杰《深入理解 AI Agent》3.1观后总结)
人工智能·学习
临床数据科学和人工智能兴趣组12 分钟前
R Markdown 如何写
人工智能·机器学习·数据分析·r语言·r语言-4.2.1
wangyue_msn_8615 分钟前
Agent知识学习笔记——01 Prompt/Function call/记忆/上下文
笔记·学习·prompt
粉色大象17 分钟前
线性代数基础知识点
人工智能·线性代数·机器学习
腾讯云大数据18 分钟前
腾讯云智能数据湖计算AI DLC发布会回顾:Spark+Ray一体化,面向Agent重构数据底座
人工智能·spark·腾讯云
呱呱巨基19 分钟前
CMake基础
linux·c++·笔记·学习
半兽先生24 分钟前
2026年RAG系统主流开源文档解析工具选型指南:PaddleOCR、MinerU、LiteParse、HunyuanOCR、Apache Tika 全面对比
人工智能·python·机器学习·ai·开源
min(a,b)24 分钟前
AI 每日学习 — RAG 效果评估体系设计与实现
学习
laboratory agent开发26 分钟前
知识库已更新,智能体为何还在用旧答案回复用户
人工智能