hadoop的MapReduce

1.什么是计算(广义): 内容分析, 得到需要的结果

也就是一系列, 基于数据得出的结论。 这些就是我们所说的计算。

2.分布式计算模式:

一:分散-汇总模式:数据分片,多个服务器负责各个部分数据处理,最后结果汇总

二:中心调度模式: 1. 由一个节点作为中心调度管理者 2. 将任务划分为几个具体步骤 3. 管理者安排每个机器执行任务 4. 最终得到结果数据

3.MapReduce(hadoop的计算组件)(hive的底层工具)

一:利用的是分散-汇总模式

二:编程接口:map(分散)与reduce(汇总)

相关推荐
菜菜艾16 分钟前
自动化环境补丁更新系统
linux·运维·bash·运维开发
HalvmånEver36 分钟前
MySQL的索引
android·linux·数据库·学习·mysql
我是发哥哈1 小时前
跨AI模型生成视频的五大维度对比:选型避坑指南
大数据·人工智能·学习·机器学习·chatgpt·音视频
逸Y 仙X2 小时前
Elasticsearch时间类型实战
java·大数据·elasticsearch·搜索引擎·全文检索
wljy13 小时前
二、静态库的制作和使用
linux·c语言·开发语言·c++
mzhan0173 小时前
Linux: coredump产生对程序退出的影响
linux·运维·服务器
光电笑映3 小时前
从环境变量到进程虚拟地址空间——Linux 内存管理的底层脉络
linux·服务器·c++·c
Dxy12393102163 小时前
Python如何处理树状分类数据
大数据·python·分类
源远流长jerry4 小时前
Linux 网络收包机制:从网卡到 Socket 的完整路径
linux·运维·服务器·网络·网络协议·tcp/ip
凡人AI录4 小时前
小红书商业变现 100 个关键词:从流量逻辑到长期复利
大数据