Spark:背压机制

 Spark1.5以前版本,用户如果想要限制Receiver的数据接收速率,可以通过设置静态配置参数"spark.streaming.receiver.maxRate"的值来实现,此举虽然可以通过限制接收速率,来适配当前的处理能力,防止内存溢出,但也会引入其他问题,比如:producer数据生产高于maxRate,当前集群处理能力也高于maxRate,这就会造成资源利用率下降等问题。

 为了更好的协调数据接收速率与资源处理能力,1.5版本开始SparkStreaming可以动态控制数据接收速率来适配集群数据处理能力,背压机制(Spark Streaming Backpressure):根据JobScheduler反馈作业的执行信息来动态调整Receiver数据接收率

 通过属性"spark.streaming.backpressure.enabled"来控制是否启用backpressure机制,默认值false,即不启用

相关推荐
发量惊人的中年网工22 分钟前
什么是AI基础设施出海?企业如何选择全链路闭环的海外算力部署方案
大数据·出海·ai基础设施
无忧智库31 分钟前
烟草物流企业数字化转型规划方案拆解:从战略绩效到物流作业的全链条信息化设计(PPT)
大数据·架构
fastjson_32 分钟前
Hadoop之Yarn
大数据·hadoop·npm
weixin_4462608540 分钟前
超越Top-K:用可解释智能体操作替代黑盒检索
大数据·人工智能·机器学习
Data_Journal2 小时前
如何使用 Java 和 Jsoup 解析 HTML
大数据·开发语言·数据库·python·scrapy
YOU OU2 小时前
RabbitMQ应用问题
分布式·rabbitmq
123_不打狼3 小时前
AI Agent可观测性:破解多步推理黑盒的技术实践
大数据·人工智能
用户3610588626124 小时前
Spark 核心之二次排序、分组取 TopN 优化分析
大数据·spark
ZeekerLin5 小时前
本体论Ontology在企业AI项目落地思考
大数据·人工智能·企业ai落地·本体论
七夜zippoe5 小时前
基于 DolphinDB 构建全流程质量追溯体系:从原材料到成品的全链路追踪
大数据·人工智能·算法·全链路·dolphindb·质量追溯