ETL 和 ELT区别-2

T-ETL和ELT区别_tetl-CSDN博客

ETL(提取、转换和加载)和 ELT(提取、加载和转换)是企业用来从多个源提取数据并将其组合到单个数据库或数据仓库中进行分析的过程。这两种方法都使用以下步骤(但顺序不同)来准备数据以进行分析:

  • 提取:此步骤涉及从源中提取数据,源可以是 MySQL 或 MongoDB 等数据库,也可以是 Google 表格、Google Drive 或 Salesforce 等任何其他应用程序。

  • 加载:在此步骤中,数据将加载到分析工作负载的目标仓库或数据库。

  • 转换:此步骤可用于清理、处理数据并将其转换为适合加载到目标和进一步分析的格式。

ETL ELT
数据转型 原始数据在加载到目标之前进行转换。 原始数据在加载到目标后进行转换。
加载时间 ETL 需要更多时间将数据加载到目标,因为数据首先被转换。 ELT 速度更快,因为数据直接加载到目标。
数据量 更适合需要非常复杂转换的小型数据集。 非常适合更强调获取实时数据进行分析的大型数据集。

一些新的词汇

in-flight-transformations

提取或加载过程中自动转换源数据

Schema Mapper

结构映射器:

hevodata 的 event 和 event-type

从源中获取数据称为 Hevo 中的事件摄取,而将摄取的数据复制到目标中称为事件的加载。每个 Hevo 计划每月提供固定数量的活动。读取事件用法

如何管理过程中的事件Managing Objects in Pipelines - Hevo Data

Schema Mapper Actions

  • 跳过了一行数据
  • 重置了数仓结构
  • 发现没有绑定的字段
相关推荐
Yz98761 小时前
hive的存储格式
大数据·数据库·数据仓库·hive·hadoop·数据库开发
武子康1 小时前
大数据-230 离线数仓 - ODS层的构建 Hive处理 UDF 与 SerDe 处理 与 当前总结
java·大数据·数据仓库·hive·hadoop·sql·hdfs
武子康1 小时前
大数据-231 离线数仓 - DWS 层、ADS 层的创建 Hive 执行脚本
java·大数据·数据仓库·hive·hadoop·mysql
锵锵锵锵~蒋1 小时前
实时数据开发 | 怎么通俗理解Flink容错机制,提到的checkpoint、barrier、Savepoint、sink都是什么
大数据·数据仓库·flink·实时数据开发
武子康10 小时前
Java-06 深入浅出 MyBatis - 一对一模型 SqlMapConfig 与 Mapper 详细讲解测试
java·开发语言·数据仓库·sql·mybatis·springboot·springcloud
JessieZeng aaa13 小时前
CSV文件数据导入hive
数据仓库·hive·hadoop
Yz987620 小时前
hive复杂数据类型Array & Map & Struct & 炸裂函数explode
大数据·数据库·数据仓库·hive·hadoop·数据库开发·big data
EDG Zmjjkk21 小时前
Hive 函数(实例操作版2)
数据仓库·hive·hadoop
B站计算机毕业设计超人21 小时前
计算机毕业设计SparkStreaming+Kafka新能源汽车推荐系统 汽车数据分析可视化大屏 新能源汽车推荐系统 汽车爬虫 汽车大数据 机器学习
数据仓库·爬虫·python·数据分析·kafka·数据可视化·推荐算法
Moshow郑锴1 天前
数据库、数据仓库、数据湖、数据中台、湖仓一体的概念和区别
大数据·数据库·数据仓库·数据湖·湖仓一体