hadoop的MapReduce

1.什么是计算(广义): 内容分析, 得到需要的结果

也就是一系列, 基于数据得出的结论。 这些就是我们所说的计算。

2.分布式计算模式:

一:分散-汇总模式:数据分片,多个服务器负责各个部分数据处理,最后结果汇总

二:中心调度模式: 1. 由一个节点作为中心调度管理者 2. 将任务划分为几个具体步骤 3. 管理者安排每个机器执行任务 4. 最终得到结果数据

3.MapReduce(hadoop的计算组件)(hive的底层工具)

一:利用的是分散-汇总模式

二:编程接口:map(分散)与reduce(汇总)

相关推荐
zl_dfq3 分钟前
Linux 之 【多线程】(STL、智能指针与线程安全、读者写者问题)
linux
mqffc25 分钟前
Linux(CentOS)安装 MySQL
linux·mysql·centos
SQL必知必会1 小时前
使用 SQL 实现帕累托原则(80/20 法则)
大数据·数据库·sql
IT 行者1 小时前
OpenClaw 浏览器自动化测试的那些坑(一):Linux Snap 版本的 Chromium 无法使用托管模式
linux·运维·服务器·人工智能
AI周红伟1 小时前
周红伟:智能体构建实操:OpenClaw + Agent Skills + Seedance + RAG 案例实操
大数据·人工智能·大模型·智能体
Tangcan-1 小时前
在Ubuntu 22.04上安装redis
linux·redis·ubuntu
麦德泽特1 小时前
STM32与Linux的无缝协作:通过USB CDC/VCP实现高效数据交互
linux·stm32·单片机·嵌入式硬件·安全
nita张2 小时前
战略定位实战:案例分享与经验总结
大数据·人工智能·python
云器科技2 小时前
AI × Lakehouse:云器Lakehouse + Datus 从SQL查询到自然语言交互,扩展数据团队的能力边界
大数据·人工智能·数据库架构·数据平台·湖仓平台
RisunJan3 小时前
Linux命令-lvdisplay(显示逻辑卷属性)
linux·运维·服务器