数据仓库的概念

先用大白话讲一下,数据仓库的主要目的就是存储和分析大量结构化数据的。

> 那么它的核心目的是:支持商业智能(BI)和决策支持系统,也就是说,它不仅仅是为了存储,更重要的是为了分析提供便利。

> 再来说下它的特点:面向主题的、集成的、相对稳定的、随时间变化的。而这些特点恰恰反应了数据仓库与传统数据库的区别。

> 这里就要先讲一下OLTP(联机事务处理)OLAP(联机分析处理)的区别

> 1.数据更新:OLTP系统的数据经常被更新,数据仓库的数据相对稳定,通常只定期加载。

> 2.数据模型:OLTP系统通常使用高度规范化的模型;数据仓库通常使用星型或雪花模型

> 3.查询类型:OLTP系统主要处理简单、标准化的查询;数仓用于处理复杂的分析查询。

> 4.数据范围:OLTP系统通常只保存当前的数据;数仓会保存历史的数据。

> 5.性能优化:OLTP系统优化的是写入性能;数仓优化的是读取和分析性能。

> 还有一点,数仓通常会保存多个源系统的数据。

> 举个例子总结下:

> 如果说传统数据库像是一个高效运转的工厂,那么数据仓库就像是一个大型的研究中心,存储、整理并分析大量的信息,为企业决策提供支持。

数据仓库的概念

数据仓库是一个为支持商业智能和决策分析而设计的大型数据存储和管理系统。

数据仓库和传统数据库的区别

|------|------------|-----------------|
| | OLTP | OLAP |
| 用途 | 联机事务处理 | 联机分析处理 |
| 数据更新 | 频繁更新 | 相对稳定,定期加载 |
| 数据模型 | 高度规范化 | 星型或者雪花模型,优化查询性能 |
| 查询类型 | 处理简单标准化的查询 | 处理复杂的分析查询 |
| 数据范围 | 只保存当前数据 | 保存大量的历史数据 |
| 性能优化 | 优化写入性能 | 优化读取和分析性能 |
| 数据整合 | 单一 | 整合来自多个源系统的数据 |

相关推荐
Dxy123931021621 小时前
深度解析 Elasticsearch:从倒排索引到 DSL 查询的实战突围
大数据·elasticsearch·搜索引擎
YongCheng_Liang1 天前
零基础学大数据:大数据基础与前置技术夯实
大数据·big data
AC赳赳老秦1 天前
2026国产算力新周期:DeepSeek实战适配英伟达H200,引领大模型训练效率跃升
大数据·前端·人工智能·算法·tidb·memcache·deepseek
鹏说大数据1 天前
Spark 和 Hive 的关系与区别
大数据·hive·spark
B站计算机毕业设计超人1 天前
计算机毕业设计Hadoop+Spark+Hive招聘推荐系统 招聘大数据分析 大数据毕业设计(源码+文档+PPT+ 讲解)
大数据·hive·hadoop·python·spark·毕业设计·课程设计
B站计算机毕业设计超人1 天前
计算机毕业设计hadoop+spark+hive交通拥堵预测 交通流量预测 智慧城市交通大数据 交通客流量分析(源码+LW文档+PPT+讲解视频)
大数据·hive·hadoop·python·spark·毕业设计·课程设计
数据架构师的AI之路1 天前
深入了解大数据领域Hive的HQL语言特性
大数据·hive·hadoop·ai
L***一1 天前
大数据技术专业中专生职业发展路径探析
大数据
woshikejiaih1 天前
**播客听书与有声书区别解析2026指南,适配不同场景的音频
大数据·人工智能·python·音视频
无忧智库1 天前
某市“十五五“智慧气象防灾减灾精准预报系统建设方案深度解读 | 从“看天吃饭“到“知天而作“的数字化转型之路(WORD)
大数据·人工智能