数据仓库与数据挖掘

1.数据挖掘的概念

数据挖掘(Data mining),又译为资料探勘、数据采矿。它是数据库知识发现(Knowledge-Discovery in Databases,KDD)中的一个步骤。

数据挖掘一般是指从大量的数据中通过算法搜索隐藏于其中的信息的过程。

数据挖掘通常与计算机科学有关,并通过统计、在线分析处理、情报检索、机器学习、专家系统(依靠过去的经验法则)和模式识别等诸多方法来实现上述目标。

数据挖掘是从数据库的大量数据中揭示出隐含的、先前未知的并有潜在价值的信息的非平凡过程,主要任务有聚类分析、分类分析、关联规则挖掘等。

2.数据挖掘的3个步骤

数据挖掘是通过分析每个数据,从大量数据中寻找其规律的技术,主要有数据准备、规律寻找和规律表示3个步骤。

2.1数据准备

数据准备是从相关的数据源中选取所需的数据并整合成用于数据挖掘的数据集;

2.2规律寻找

规律寻找是用某种方法将数据集所含的规律找出来;

2.3规律表示

规律表示是尽可能以用户可理解的方式(如可视化)将找出的规律表示出来。

3.数据挖掘的任务

数据挖掘的任务有关联分析、聚类分析、分类分析、异常分析、特异群组分析和演变分析等。

相关推荐
影子24014 小时前
oralce创建种子表,使用存储过程生成最大值sql,考虑并发,不考虑并发的脚本,plsql调试存储过程,java调用存储过程示例代码
java·数据库·sql
武子康4 小时前
Java-172 Neo4j 访问方式实战:嵌入式 vs 服务器(含 Java 示例与踩坑)
java·服务器·数据库·sql·spring·nosql·neo4j
昂子的博客4 小时前
Redis缓存 更新策略 双写一致 缓存穿透 击穿 雪崩 解决方案... 一篇文章带你学透
java·数据库·redis·后端·spring·缓存
xixixi777774 小时前
了解一下APM工具——就像给软件系统装的“全身CT”,能实时透视从用户点击到后端数据库的每个环节性能,精准定位哪里慢、为什么慢
数据库·安全·数据采集·apm·日志监控
q***9945 小时前
PON架构(全光网络)
网络·数据库·架构
Leon-Ning Liu5 小时前
Oracle查看正在rebuild online的索引
数据库·oracle
bhots￿5 小时前
oracle 物化视图设置自动更新日志
数据库·oracle
苦学编程的谢5 小时前
Redis_12_持久化(1)
数据库·redis·缓存
百***46805 小时前
MySQL的底层原理与架构
数据库·mysql·架构
百***12225 小时前
Redis开启远程访问
数据库·redis·缓存