信息检索与数据挖掘 |(一)介绍

文章目录

📚信息检索

🐇概念

  • 信息检索是从大型集合 (通常存储在计算机上)中寻找非结构化 (通常是文本)的材料(通常是文档),以满足信息需求。

🐇结构化与非结构化数据

  • 结构化数据 倾向于引用"表格"中的信息,通常允许数值范围和精确匹配查询。
  • 非结构化数据通常引用自由文本,允许关键字查询(包括操作符)以及更复杂的"概念"查询。它是文本文档检索的经典模型。
  • 结构化数据即行数据,存储在数据库里,可以用二维表结构来逻辑表达实现的数据。
  • 非结构化数据是相对于结构化数据而言的,不方便用数据库二维逻辑表来表现的数据。

🐇信息检索的基本假设

  • 集合:一组文档(假设它目前是静态集合)。
  • 目标:检索与用户信息需求相关的文档,并帮助用户完成任务。
  • 经典搜索模型

🐇信息检索小结


🐇附:IR新课题







📚数据挖掘

🐇定义

🐇数据挖掘 vs 机器学习

  • AI说:
    • 数据挖掘和机器学习都是处理大数据的方法,它们之间的区别在于目的和方法。
    • 数据挖掘旨在寻找数据中的模式、规律和关系,以从中提取有价值的信息。数据挖掘的方法是使用各种技术和算法,例如聚类、分类、关联规则挖掘等。
    • 机器学习则是一种人工智能技术,在某种程度上可以看做是数据挖掘的一种扩展。机器学习旨在让计算机根据数据自主学习,建立模型,从而预测、分类或识别未来的数据。机器学习的方法包括监督学习、无监督学习和半监督学习等。

  • 数据挖掘是用来理解事物的。

  • 机器学习是用来预测事物的。

  • 人工智能是用来生成行动的。


  • Data contains value and knowledge.
  • Data mining around us.

🔥分类


🔥聚类
🔥降维

相关推荐
武子康1 分钟前
Java-182 OSS 权限控制实战:ACL / RAM / Bucket Policy 与错误排查
java·数据库·阿里云·云计算·oss·fastdfs·fdfs
沫儿笙3 分钟前
柯马弧焊机器人气流智能调节
人工智能·物联网·机器人
李慕婉学姐3 分钟前
基于微信小程序的康复医疗问诊服务平台5855qb95(程序+源码+数据库+调试部署+开发环境)带论文文档1万字以上,文末可获取,系统界面在最后面。
数据库·spring boot·微信小程序
love530love5 分钟前
【SD WebUI踩坑】启动报错 Expecting value: line 1 column 1 (char 0) 的终极解决方案
人工智能·windows·python·github·stablediffusion
linux修理工6 分钟前
vagrant ansible 配置
linux·运维·服务器·数据库·centos
木棉知行者6 分钟前
【第5篇】InceptionNeXT(CVPR2024):融合 Inception 思想与现代 CNN 设计的高效特征提取架构
人工智能·深度学习·计算机视觉·cnn
一只落魄的蜂鸟8 分钟前
《图解技术体系》Three architectures and application scenarios of Redis
数据库·redis·缓存
技术支持者python,php8 分钟前
训练分类识别器
人工智能·分类·数据挖掘
DX_水位流量监测8 分钟前
管网液位计的技术特性与工程应用解析
大数据·网络·人工智能·信息可视化·架构
paperxie_xiexuo9 分钟前
从数据到话语:面向期刊知识转化的智能写作协同机制研究
大数据·人工智能·ai写作·期刊论文