- 实时数仓中,为什么没有零点漂移问题?
- 因为flink直接取的事件时间
- 用kafka是为了速度快,并且数据不丢,那为什么既用了kafkachannel,也用了kafka,而不只用kafkachannel呢?
- 因为需要削峰填谷
- 离线数仓中,为什么用两个flume,一个kafka,直接用taildirsource,kafkachannel,hdfssink不行吗?
- 不行
- kafka可以削峰填谷
- 如果用kafkachannel,那么数据写到kafka,只剩event,没有header,无法解决零点漂移问题,而多加一个flume,可以在kafkasource中添加拦截器。
离线数仓中,为什么用两个flume,一个kafka
青云游子2023-08-03 12:44
相关推荐
事变天下6 小时前
迈瑞的足球之夏:从一次救援到全球守护中微极客7 小时前
多智能体编排实战:CrewAI vs AutoGen(2026版)西邮彭于晏7 小时前
图文详解:Git分支创建、合并与冲突解决|新手零门槛完整教程香菜TTT8 小时前
Kafka_深度解析_从架构原理到生产实践IanSkunk9 小时前
企业AI办公落地技术拆解:从WorkBuddy任务引擎到JOTO实施路径Xvisio诠视科技9 小时前
从“感知”到“理解”:空间计算如何成为具身智能世界模型的“数据底座”?jerryinwuhan10 小时前
数据预处理技术 2026-2027-1 开篇-课程介绍Elastic 中国社区官方博客10 小时前
Elastic 和 OpenAI 合作,将前沿智能引入非结构化企业数据西邮彭于晏12 小时前
Git 标签(Tag)与版本发布完整指南|附全场景命令速查表梵构广告12 小时前
平台怎么做品牌营销策划?—品牌营销