- 精准一次怎么保证?可以设置为以下2个
- 对齐
- 当有一个barrier比较快时,输入缓冲区阻塞,当另外一个barrier到来时,才进行备份,所以数据不会重复。
- 优点:不会造成数据重复
- 缺点:会造成数据积压,OOM
- 不对齐
- 当有一个barrier到来时,直接将barrier置到最后,然后将所有缓冲区的数据和状态进行备份,然后将kafka提交,然后将慢的barrier也置到最后,将所有缓冲区的数据和状态进行备份,然后将kafka提交。
- 优点:加快了ck
- 缺点:由于备份了大量数据,会造成IO压力大,磁盘存储压力大
- 对齐
- 至少一次怎么保证?
- 对齐
- 当有一个barrier比较快时,输入缓冲区不阻塞,直接向下游流动,而barrier会等待另外一个barrier,当此次ck备份成功后,JM注入新的barrier,然后到一半的时候,备份失败了,kafka回滚,从HDFS中恢复上次的ck,恢复kafka的offset,由于不阻塞,所以会重新从kafka中拉取到重复的数据进行计算,就造成了数据的重复,就是至少一次语义。
- 优点:不阻塞,不会造成数据积压,OOM
- 缺点,会造成数据重复
flink-对齐和不对齐,精准一次和至少一次
青云游子2023-08-14 9:24
相关推荐
kft131418 分钟前
AI 驱动测试 2.0:当测试智能体成为你的“超级 QA“亿信华辰软件43 分钟前
睿治Agent数据治理平台重磅发布:数据治理大脑+全栈Agent,以AI重构数据治理全流程成长之路5141 小时前
【数据集】地级市农业韧性数据-含代码(1990-2023年)CyberwayTech3 小时前
赛博威线上营销费用管理:咨询+系统,双轮驱动ROI增长NOCSAH3 小时前
统好AI:助力企业智改数转的务实实践Sinokap3 小时前
GPT-5.5 上线:OpenAI 把 AI 推向真实办公场景七颗糖很甜3 小时前
“十五五”气象发展规划:聚焦五大核心任务科研前沿3 小时前
镜像视界浙江科技有限公司的关键技术突破有哪些?captain_AIouo3 小时前
聚焦实操赋能,Captain AI系统功能实操指南及价值解读个微管理3 小时前
小红书新规深度拆解:从被封到破局,2026年矩阵号生存手册