尚硅谷大数据技术-数据湖Hudi视频教程-笔记02【核心概念(基本概念、数据写、数据读)】

大数据新风口:Hudi数据湖(尚硅谷&Apache Hudi联合出品)

  1. B站直达:https://www.bilibili.com/video/BV1ue4y1i7na 尚硅谷数据湖Hudi视频教程
  2. 百度网盘:https://pan.baidu.com/s/1NkPku5Pp-l0gfgoo63hR-Q?pwd=yyds
  3. 阿里云盘:https://www.aliyundrive.com/s/uMCmjb8nGaC(教程配套资料请从百度网盘下载)

  1. 尚硅谷大数据技术-数据湖Hudi视频教程-笔记01【概述、编译安装】

  2. 尚硅谷大数据技术-数据湖Hudi视频教程-笔记02【核心概念(基本概念、数据写、数据读)】

  3. 尚硅谷大数据技术-数据湖Hudi视频教程-笔记03【集成Spark】

  4. 尚硅谷大数据技术-数据湖Hudi视频教程-笔记04【集成Flink】

  5. 尚硅谷大数据技术-数据湖Hudi视频教程-笔记05【集成Hive】

目录

[第3章 核心概念](#第3章 核心概念)

010

011

012

013

014

015

016

017

018

019

020

021

022

023

024

025


第3章 核心概念

010

++第3章 核心概念++

++3.1 基本概念++

++3.1.1 时间轴(TimeLine)++

011

++3.1.2 文件布局(File Layout)++

012

++3.1.2 文件布局(File Layout)++

013

++3.1.3 索引(Index)++

1)原理

014

++3.1.3 索引(Index)++

2)索引选项

015

++3.1.3 索引(Index)++

3)全局索引与非全局索引

016

++3.1.3 索引(Index)++

4)索引的选择策略

017

++3.1.4 表类型(Table Types)++

1)Copy On Write

018

++3.1.4 表类型(Table Types)++

2)Merge On Read

019

++3.1.4 表类型(Table Types)++

3)COW与MOR的对比

cow:批处理、mor:流批都行,更推荐流。

020

++3.1.5 查询类型(Query Types)++

1)Snapshot Queries 快照查询:全量最新。

2)Incremental Queries

3)Read Optimized Queries

021

++3.1.5 查询类型(Query Types)++

4)不同表支持的查询类型

022

++3.2 数据写++

++3.2.1 写操作++

++3.2.2 写流程(UPSERT)++

1)Copy On Write

2)Merge On Read

023

++3.2.3 写流程(INSERT)++

1)Copy On Write

2)Merge On Read

++3.2.4 写流程(INSERT OVERWRITE)++

1)COW

2)MOR

3)优点

4)缺点

024

++3.2.5 Key 生成策略++

++3.2.6 删除策略++

1)逻辑删

2)物理删

++3.2.7 总结++

025

++3.3 数据读++

++3.3.1 Snapshot读++

++3.3.2 Incremantal读++

++3.3.3 Streaming读++

++3.4 Compaction++

相关推荐
深鱼~16 小时前
从本地存储到全球访问:1Panel的家庭服务器革命
大数据·运维·服务器
档案宝档案管理19 小时前
打破数据孤岛:制造行业档案管理方案如何实现数据互通与协同?
大数据·档案·档案管理
鹧鸪云光伏与储能软件开发20 小时前
光伏开发小程序:快速获客,成交项目更迅速
大数据·微信小程序·小程序·光伏
淞宇智能科技20 小时前
固态电池五大核心设备全解析
大数据·人工智能·自动化
武子康20 小时前
大数据-141 ClickHouse 副本实战 | ReplicatedMergeTree + ZooKeeper 从 0–1:创建、选举、日志复制、排障
大数据·后端·nosql
麦麦大数据20 小时前
F043 vue+flask天气预测可视化系统大数据+机器学习+管理端+爬虫+超酷界面+顶级可视化水平 【黑色版】
大数据·vue.js·flask·天气预测·气温预测·天气大数据·天气可视化
大明者省21 小时前
大模型微调怎么实现?当然不是人工对一些参数微小调整!
大数据·人工智能
麦麦大数据21 小时前
F043 vue+flask天气预测可视化系统大数据(浅色版)+机器学习+管理端+爬虫+超酷界面+顶级可视化水平
大数据·vue.js·机器学习·flask·空气质量·天气预测·气温预测
琉璃色的星辉1 天前
Flink-2.0.0在配置文件中修改.pid文件存储位置及其他默认参数
大数据·flink·环境配置·修改参数