数据仓库面试题集&离线&实时

一、Flink面试问题集

1、flink+kafka 如何保证精准一次

  • 配置
  • 两阶段提交

2、Flink提交方式, 使用pre-job还是yarn-session模式,以及Application模式,好处?

3、Flink UV统计实现

  • set
  • 布隆过滤器+redis 有误差
  • HyperLogLog

4、Flink的CEP实现延迟支付提醒

5、Flink Join方式

6、Time-Watermark

7、动态表

8、Flink数据倾斜如何处理

二、Spark面试问题集

三、数据仓库

酒店行业数据仓库
数据仓库设计

1、数仓搭建规范说一下,表命名规范、数仓分层、数仓主题、数据域、业务域等

2、结合自己负责的业务主线,详细简述一个主题,业务流程、概念模型、实体节点

3、主题域-一级主题-业务过程 ,描述自己在这个过程中做了哪些事情

相关推荐
神秘打工猴1 小时前
数据仓库为什么要分层
大数据·数据仓库·spark
Hard_pea1 小时前
Spark 深入解析
大数据·分布式·spark
猪猪果泡酒1 小时前
spark yum配置
spark
闯闯桑2 小时前
Scala 中的访问修饰符
大数据·开发语言·scala
后端小肥肠2 小时前
解锁DeepSpeek-R1大模型微调:从训练到部署,打造定制化AI会话系统
大数据·人工智能
24k小善10 小时前
flink集成tidb cdc
大数据·flink·tidb
StableAndCalm11 小时前
什么是hive
数据仓库·hive·hadoop
kngines12 小时前
【实战ES】实战 Elasticsearch:快速上手与深度实践-3.2.3 案例:新闻搜索引擎的相关性优化
大数据·elasticsearch·搜索引擎
秦南北13 小时前
国内领先的宠物类电商代运营公司品融电商
大数据·人工智能·电商
problc15 小时前
Manus AI 全球首款通用型 Agent,中国制造
大数据·人工智能·制造