Hadoop集群的常用命令

Hadoop集群的常用命令涵盖了文件系统操作、作业管理、集群监控等多个方面。以下是一些常用的Hadoop命令及其用途:

文件系统操作

Hadoop分布式文件系统(HDFS)是Hadoop的核心组件之一,以下命令用于管理HDFS中的文件和目录。

复制代码
hadoop fs -ls <path>

列出指定路径下的文件和目录。

复制代码
hadoop fs -mkdir <path>

在HDFS中创建目录。

复制代码
hadoop fs -put <local_path> <hdfs_path>

将本地文件或目录上传到HDFS。

复制代码
hadoop fs -get <hdfs_path> <local_path>

将HDFS中的文件或目录下载到本地。

复制代码
hadoop fs -rm <path>

删除HDFS中的文件或目录。

复制代码
hadoop fs -cat <path>

查看HDFS中文件的内容。

作业管理

Hadoop MapReduce是Hadoop的另一个核心组件,以下命令用于管理MapReduce作业。

复制代码
hadoop jar <jar_file> <main_class> <input_path> <output_path>

提交一个MapReduce作业。

复制代码
hadoop job -list

列出当前正在运行和已完成的作业。

复制代码
hadoop job -kill <job_id>

终止指定的MapReduce作业。

复制代码
hadoop job -status <job_id>

查看指定作业的状态。

集群监控

以下命令用于监控Hadoop集群的状态和性能。

复制代码
hadoop dfsadmin -report

查看HDFS集群的状态报告,包括节点信息、存储使用情况等。

复制代码
hadoop dfsadmin -safemode enter

将HDFS集群进入安全模式,此时只能读取数据,不能写入。

复制代码
hadoop dfsadmin -safemode leave

将HDFS集群退出安全模式,恢复正常读写操作。

复制代码
hadoop fsck <path>

检查HDFS中指定路径的文件系统健康状况。

其他常用命令

复制代码
hadoop version

查看Hadoop的版本信息。

复制代码
hadoop classpath

查看Hadoop的类路径。

复制代码
hadoop namenode -format

格式化HDFS的NameNode,通常在首次启动Hadoop集群时使用。


启动/停止服务

复制代码
   - start-dfs.sh

启动HDFS

复制代码
   - stop-dfs.sh

停止HDFS

复制代码
   - start-yarn.sh

启动YARN

复制代码
   - stop-yarn.sh

停止YARN

相关推荐
青云交2 小时前
Java 大视界 -- Java 大数据机器学习模型在金融信用评级模型优化与信用风险动态管理中的应用(371)
java·大数据·机器学习·信用评级·动态风控·跨境金融·小贷风控
笙囧同学5 小时前
基于大数据技术的疾病预警系统:从数据预处理到机器学习的完整实践(后附下载链接)
大数据·网络·机器学习
java叶新东老师13 小时前
git 提交时排除一个或多个文件
大数据·git·elasticsearch
阿里云大数据AI技术14 小时前
Hologres V3.1版本发布,Serverless型实例从零开始构建OLAP系统
大数据·人工智能·机器学习
秋难降15 小时前
一篇文章带你了解Pandassssssssssssssss
大数据·python·pandas
数据皮皮侠16 小时前
中国汽车能源消耗量(2010-2024年)
大数据·数据库·人工智能·物联网·金融·汽车·能源
TDengine (老段)16 小时前
TDengine 转化函数 TO_TIMESTAMP 用户手册
java·大数据·数据库·物联网·时序数据库·tdengine·涛思数据
LiRuiJie17 小时前
基于Hadoop3.3.4+Flink1.17.0+FlinkCDC3.0.0+Iceberg1.5.0整合,实现数仓实时同步mysql数据
大数据·hadoop·flink·iceberg·flinkcdc
cici1587417 小时前
Docker搭建Hadoop集群
hadoop·docker·eureka
时序数据说17 小时前
时序数据库IoTDB的优势场景分析
大数据·数据库·物联网·时序数据库·iotdb