hadoop的常用命令

Hadoop集群中包含了多个组件,如HDFS(Hadoop Distributed File System)、YARN(Yet Another Resource Negotiator)等,以下是一些常用的命令:

HDFS相关命令

  1. **查看文件系统**
  • `hdfs dfs -ls`:列出文件系统中的文件和目录。

  • `hdfs dfs -ls -h`:以更易读的格式显示文件大小。

  • `hdfs dfs -ls -R`:递归显示目录下的所有文件和子目录。

  • `hdfs dfs -ls /`:查看根目录下的内容。

  1. **创建目录**
  • `hdfs dfs -mkdir /path/to/directory`:创建指定目录。

  • `hdfs dfs -mkdir -p /path/to/directory`:递归创建目录,如果父目录不存在会自动创建。

  1. **上传文件**
  • `hdfs dfs -put localfile /path/to/hdfs`:将本地文件上传到HDFS指定路径。

  • `hdfs dfs -copyFromLocal localfile /path/to/hdfs`:与`put`命令功能相同。

  1. **下载文件**
  • `hdfs dfs -get /path/to/hdfs localfile`:将HDFS中的文件下载到本地。

  • `hdfs dfs -copyToLocal /path/to/hdfs localfile`:与`get`命令功能相同。

  1. **删除文件或目录**
  • `hdfs dfs -rm /path/to/file`:删除指定文件。

  • `hdfs dfs -rm -r /path/to/directory`:递归删除目录及其内容。

  • `hdfs dfs -rm -r -f /path/to/directory`:强制删除目录及其内容,不提示确认。

  1. **查看文件内容**
  • `hdfs dfs -cat /path/to/file`:查看文件内容。

  • `hdfs dfs -tail /path/to/file`:查看文件的最后部分内容。

  1. **查看文件系统状态**
  • `hdfs dfsadmin -report`:查看HDFS集群的健康状态和存储情况。

  • `hdfs dfs -df -h`:查看HDFS的磁盘使用情况。

YARN相关命令

  1. **查看YARN集群状态**
  • `yarn cluster -status`:查看YARN集群的运行状态。

  • `yarn node -status`:查看节点状态。

  1. **查看正在运行的作业**
  • `yarn application -list`:列出所有正在运行的作业。

  • `yarn application -status application_id`:查看指定作业的状态。

  1. **杀死作业**
  • `yarn application -kill application_id`:终止指定的作业。
  1. **查看队列信息**
  • `yarn queue -status`:查看队列的使用情况和状态。

Hadoop守护进程相关命令

  1. **启动Hadoop集群**
  • `start-dfs.sh`:启动HDFS守护进程。

  • `start-yarn.sh`:启动YARN守护进程。

  • `start-all.sh`:启动HDFS和YARN守护进程(不推荐使用,建议分别启动)。

  1. **停止Hadoop集群**
  • `stop-dfs.sh`:停止HDFS守护进程。

  • `stop-yarn.sh`:停止YARN守护进程。

  • `stop-all.sh`:停止HDFS和YARN守护进程。

  1. **格式化HDFS文件系统**
  • `hdfs namenode -format`:格式化HDFS文件系统,通常在首次安装或重置集群时使用。
  1. **查看守护进程状态**
  • `jps`:查看当前Java进程,包括Hadoop守护进程。

这些命令是Hadoop集群操作的基础,根据实际需求,可能还需要结合其他工具和命令进行更复杂的操作。

基于ai生成 可能有误

相关推荐
yumgpkpm2 天前
CMP(类ClouderaCDP7.3(404次编译) )完全支持华为鲲鹏Aarch64(ARM),粉丝数超过200就开源下载
hive·hadoop·redis·mongodb·elasticsearch·hbase·big data
B站_计算机毕业设计之家3 天前
Spark微博舆情分析系统 情感分析 爬虫 Hadoop和Hive 贴吧数据 双平台 讲解视频 大数据 Hadoop ✅
大数据·hadoop·爬虫·python·数据分析·1024程序员节·舆情分析
大叔_爱编程3 天前
基于随机森林算法的Boss直聘数据分析及可视化-hadoop+django+spider
hadoop·django·1024程序员节·spider·随机森林算法·boss直聘
毕设源码-赖学姐3 天前
【开题答辩全过程】以基于Hadoop的电商数据分析系统为例,包含答辩的问题和答案
大数据·hadoop·分布式·1024程序员节
阿什么名字不会重复呢4 天前
Hadoop报错 Couldn‘t find datanode to read file from. Forbidden
大数据·hadoop·分布式
通往曙光的路上4 天前
day17_cookie_webstorage
数据仓库·hive·hadoop
B站_计算机毕业设计之家6 天前
python股票交易数据管理系统 金融数据 分析可视化 Django框架 爬虫技术 大数据技术 Hadoop spark(源码)✅
大数据·hadoop·python·金融·spark·股票·推荐算法
随心............6 天前
sqoop采集完成后导致hdfs数据与Oracle数据量不符的问题。怎么解决?
hive·hadoop·sqoop
Aurora_eye7 天前
记录之Ubuntu22.4虚拟机及hadoop为分布式安装
大数据·hadoop·分布式
随心............8 天前
在开发过程中遇到问题如何解决,以及两个经典问题
hive·hadoop·spark