Windows如何安装hadoop

Hadoop是一个开源的分布式计算平台,旨在处理大规模数据的存储和处理。它提供了分布式文件系统(HDFS)和分布式计算框架(MapReduce),使得用户能够在大规模集群上存储和处理数据。Hadoop最初由Apache软件基金会开发,现已成为处理大数据的主流解决方案之一。

Hadoop的核心组件包括:

  1. Hadoop分布式文件系统(HDFS):用于存储大规模数据集,并提供高可靠性和容错性。
  2. MapReduce:一种分布式数据处理模型和编程框架,用于在Hadoop集群上进行数据处理。
  3. YARN(Yet Another Resource Negotiator):资源管理器,用于在Hadoop集群上分配和管理资源,支持多种数据处理框架。

除了这些核心组件之外,Hadoop生态系统还包括各种相关项目和工具,如Hive(用于数据仓库查询和分析)、HBase(分布式NoSQL数据库)、Spark(高性能通用计算引擎)、Flink(流处理引擎)等,这些工具可以与Hadoop集成,扩展其功能,满足不同的数据处理需求。

1、下载hadoop

hadoop下载链接: link

2、下载之后加压缩到对应的位置

3、配置环境变量

3.1新建系统变量》变量名:HADOOP_HOME 变量值:hadoop安装的路径

3.2系统变量path中新建两个变量值 %HADOOP_HOME%\bin %HADOOP_HOME%\sbin

4、检查hadoop是否安装成功

win+r 输入cmd 在输入 hadoop version

相关推荐
问道飞鱼16 分钟前
【大数据知识】今天聊聊Clickhouse部署方案
大数据·clickhouse·部署
金融小师妹3 小时前
应用BERT-GCN跨模态情绪分析:贸易缓和与金价波动的AI归因
大数据·人工智能·算法
武子康3 小时前
大语言模型 10 - 从0开始训练GPT 0.25B参数量 补充知识之模型架构 MoE、ReLU、FFN、MixFFN
大数据·人工智能·gpt·ai·语言模型·自然语言处理
2401_cf4 小时前
为什么hadoop不用Java的序列化?
java·hadoop·eclipse
残花月伴5 小时前
springCloud/Alibaba常用中间件之Seata分布式事务
分布式·spring cloud·中间件
睎zyl7 小时前
Spark自定义分区器-基础
大数据·分布式·spark
巨龙之路8 小时前
【TDengine源码阅读】DLL_EXPORT
大数据·时序数据库·tdengine
元6339 小时前
搭建spark-local模式
大数据·spark
巨龙之路9 小时前
TDengine编译成功后的bin目录下的文件的作用
大数据·时序数据库·tdengine
莫叫石榴姐9 小时前
大模型在数据分析领域的研究综述
大数据·数据挖掘·数据分析