数据仓库面试题集&离线&实时

一、Flink面试问题集

1、flink+kafka 如何保证精准一次

  • 配置
  • 两阶段提交

2、Flink提交方式, 使用pre-job还是yarn-session模式,以及Application模式,好处?

3、Flink UV统计实现

  • set
  • 布隆过滤器+redis 有误差
  • HyperLogLog

4、Flink的CEP实现延迟支付提醒

5、Flink Join方式

6、Time-Watermark

7、动态表

8、Flink数据倾斜如何处理

二、Spark面试问题集

三、数据仓库

酒店行业数据仓库
数据仓库设计

1、数仓搭建规范说一下,表命名规范、数仓分层、数仓主题、数据域、业务域等

2、结合自己负责的业务主线,详细简述一个主题,业务流程、概念模型、实体节点

3、主题域-一级主题-业务过程 ,描述自己在这个过程中做了哪些事情

相关推荐
狒狒热知识3 分钟前
2026软文发稿平台哪家好?内容分层+资源联动打造新闻发稿标杆企业
大数据·人工智能·产品运营
你才是臭弟弟29 分钟前
Apache Iceberg核心特征
大数据·apache
阳艳讲ai33 分钟前
九尾狐AI:重构企业AI生产力的实战革命
大数据·人工智能
新诺韦尔API34 分钟前
手机空号检测接口技术对接常见问题汇总
大数据·开发语言·python·api
德彪稳坐倒骑驴35 分钟前
Spark入门知识
大数据·分布式·spark
第二只羽毛37 分钟前
搜索引擎项目
大数据·前端·c++·搜索引擎·vim
徐礼昭|商派软件市场负责人1 小时前
AI 重构网购体验:从 “将就” 到 “讲究” 的消费者进化史|徐礼昭
大数据·人工智能·重构·智能客服·零售·智能搜索·ai推荐
无忧智库1 小时前
深度解析:某流域水务集团“数字孪生流域”建设工程可行性研究报告(万字长文)(WORD)
大数据·人工智能
耿小洋1 小时前
匡优 Excel 数据分析指令模板清单:从入门到实战
大数据·人工智能·数据挖掘
Solar20251 小时前
机械制造ToB企业获客困境与数字化解决方案架构深度解析
大数据·人工智能·架构