数据挖掘笔记part one (认识数据挖掘)

定义

从大量的,不完全的,有噪音的,模糊的,随机的数据中提取出存在潜在价值信息和知识的过程。

数据,信息,知识的关系

数据>信息>情报>知识>智慧(越小越精炼,越牛)

数据挖掘流程

数据--(筛选)--目标数据--(预处理)--已处理数据--(变换)--变换后数据--(数据挖掘)--模式

关联规则挖掘

通过样本数据来预测-------买面包后是否买牛奶的问题

分类和聚类

分类:有标签的学习(有对数据的明确定义,然后在对数据贴标签)

聚类:有学习的标签(先对数据进行学习,后面在判断并贴上标签)

eg:人的认识是从聚类到分类的过程

相关推荐
飞Link2 分钟前
2000 亿砸向算力:字节跳动 AI 基建跨越,后端与运维的“万亿 Token”生死战
运维·人工智能
zhangfeng113315 分钟前
小龙虾 wordbuddy 安装浏览器控制器 agent-browser npm install -g agent-browse
前端·人工智能·npm·node.js
阿里云大数据AI技术15 分钟前
一条 SQL 生成广告:Hologres 如何实现素材生成到投放分析一体化
人工智能·sql
liudanzhengxi23 分钟前
GitSubmodule避坑全攻略
人工智能·新人首发
用户4252108006025 分钟前
Claude Code Linux 服务器部署与配置
人工智能
OJAC11128 分钟前
学过Python却不敢投AI岗,他最后拿下12K offer
人工智能
Bigger29 分钟前
因为看不懂小棉袄的画,我写了个 AI 程序帮我“翻译”她的世界
前端·人工智能·ai编程
CeshirenTester31 分钟前
LangChain的工具调用 vs 原生Skill API:性能差在哪儿?
java·人工智能·langchain
爱问的艾文43 分钟前
八周带你手搓AI应用-第二周-让AI更像人-第1天-流式输出改造
人工智能
kdxiaojie1 小时前
U-Boot分析【学习笔记】(3)
linux·笔记·学习