- 实时数仓中,为什么没有零点漂移问题?
- 因为flink直接取的事件时间
- 用kafka是为了速度快,并且数据不丢,那为什么既用了kafkachannel,也用了kafka,而不只用kafkachannel呢?
- 因为需要削峰填谷
- 离线数仓中,为什么用两个flume,一个kafka,直接用taildirsource,kafkachannel,hdfssink不行吗?
- 不行
- kafka可以削峰填谷
- 如果用kafkachannel,那么数据写到kafka,只剩event,没有header,无法解决零点漂移问题,而多加一个flume,可以在kafkasource中添加拦截器。
离线数仓中,为什么用两个flume,一个kafka
青云游子2023-08-03 12:44
相关推荐
大数据CLUB2 小时前
基于spark的航班价格分析预测及可视化格调UI成品2 小时前
预警系统安全体系构建:数据加密、权限分级与误报过滤方案reddingtons5 小时前
Adobe Firefly AI驱动设计:实用技巧与创新思维路径G皮T6 小时前
【Elasticsearch】全文检索 & 组合检索Cachel wood9 天前
Spark教程6:Spark 底层执行原理详解Sally璐璐9 天前
数据标注工具详解找不到、了9 天前
kafka消费的模式及消息积压处理方案云宏信息10 天前
金融vmware替换过程中关于利旧纳管、迁移、数据安全容灾备份、成本及案例|金融行业数字化QA合集④时序数据说10 天前
时序数据库IoTDB数据导入与查询功能详解引量AI10 天前
TikTok 矩阵如何快速涨粉