分布式通用计算——MapReduce(重点在shuffle 阶段)

图片均来源于B站:哈喽鹏程

面向批处理的分布式计算框架------MapReduce

  • [1、Mapreduce 起源](#1、Mapreduce 起源)
  • 2、适用场景
  • [3、MapReduce 词频统计原理](#3、MapReduce 词频统计原理)

1、Mapreduce 起源


2、适用场景

3、MapReduce 词频统计原理

  • map 阶段到reduce阶段,通过hash取模来实现reduce 。比如:有4个reduce块,通过将map<key,value>中的key转换为数值,除以4.取模进行归类。


相关推荐
夏天吃哈密瓜1 小时前
Scala中的正则表达式01
大数据·开发语言·后端·正则表达式·scala
Lalolander2 小时前
2024信创数据库TOP30之华为Gauss DB
大数据·数据库·科技·华为·系统架构
天冬忘忧3 小时前
Flink四大基石之CheckPoint(检查点) 的使用详解
大数据·python·flink
The博宇5 小时前
Spark常问面试题---项目总结
大数据·分布式·spark
MXsoft6185 小时前
智能运维视角下的网络设备监测与数据分析
大数据·运维·数据库
冧轩在努力5 小时前
redis的应用--分布式锁
数据库·redis·分布式
AI航海家(Ethan)5 小时前
分布式爬虫那些事儿
分布式·爬虫
B站计算机毕业设计超人6 小时前
计算机毕业设计Python异常流量检测 流量分类 流量分析 网络流量分析与可视化系统 网络安全 信息安全 机器学习 深度学习
大数据·人工智能·python·深度学习·web安全·机器学习·课程设计
jc581276 小时前
PHP RabbitMQ连接超时问题
分布式·rabbitmq
java1234_小锋6 小时前
Zookeeper的通知机制是什么?
分布式·zookeeper·云原生