技术栈

uniffle

大大大大晴天️
2 小时前
大数据·uniffle
每天认识一个组件:统一 Shuffle 引擎Apache Uniffle在 Spark、MapReduce、Tez 等分布式计算任务中,Shuffle 往往是最容易放大性能瓶颈和稳定性问题的环节。在传统 Spark Shuffle 中,Map 端会把中间数据落在 Executor 所在节点的本地磁盘上,Reduce 端再跨节点拉取这些数据。这个模式在中小规模任务中足够直接,但在大规模集群、动态资源调度、云原生环境和超大 Shuffle 作业中,会暴露几个典型问题。
我是有底线的