hadoop的MapReduce

1.什么是计算(广义): 内容分析, 得到需要的结果

也就是一系列, 基于数据得出的结论。 这些就是我们所说的计算。

2.分布式计算模式:

一:分散-汇总模式:数据分片,多个服务器负责各个部分数据处理,最后结果汇总

二:中心调度模式: 1. 由一个节点作为中心调度管理者 2. 将任务划分为几个具体步骤 3. 管理者安排每个机器执行任务 4. 最终得到结果数据

3.MapReduce(hadoop的计算组件)(hive的底层工具)

一:利用的是分散-汇总模式

二:编程接口:map(分散)与reduce(汇总)

相关推荐
白鸽梦游指南4 分钟前
docker镜像优化
linux·运维·docker
A.A呐10 分钟前
【Linux第十九章】网络基础
linux·网络
tian_jiangnan12 分钟前
flink大数据15天速成教程
大数据·flink
陳103020 分钟前
Linux:基础开发工具
linux·运维·服务器
sg_knight24 分钟前
CentOS 裸机实操:5分钟完成 MinIO 单机部署与公网访问
linux·python·centos·文件管理·minio·ftp·oss
dgvri26 分钟前
Linux(CentOS)安装 MySQL
linux·mysql·centos
Coder个人博客27 分钟前
06_apollo_third_party子模块整体软件架构深入分析文档
linux·人工智能·架构
我爱学习好爱好爱35 分钟前
Ansible 常用模块详解:cron、archive、unarchive实战
linux·服务器·ansible
一休哥※40 分钟前
ClawTeam 完整使用教程:用 AI 多智能体团队自动完成复杂任务
大数据·人工智能·elasticsearch
十年编程老舅40 分钟前
Linux 多线程高并发编程:读写锁的核心原理与底层实现
linux·c++·linux内核·高并发·线程池·多线程·多进程