1.自我介绍
2.数据流程
3.说下自己写过的脚本
4.关于hive提问
4.1 如何把服务器中的数据上传到hive表里面
4.2 hive中的一个表分区的数据怎么导入到另一个表中的分区中。
4.3 如果一个字段 不为空,取空值,如果字段为空,取默认值
4.4 udf, udtf使用场景
5.Flink的数据一致性
Flink中在kafka中数据重新再写回到kafka里面有什么好处。
6.项目中为什么使用orc和snappy? 对比其他的存储算法,有什么好处。
7.你们是自己做运维的吗,集群中出现一些问题,该如何解决。
总结----
面试过程中出现了一些卡顿,主要是场景题时。