Hadoop 的基本 shell 命令

Hadoop 的基本 shell 命令主要用于与 Hadoop 分布式文件系统(HDFS)和 MapReduce 进行交互。以下是一些常用的 Hadoop shell 命令:

一、 HDFS 命令

  1. 查看 HDFS 状态

`hdfs dfsadmin -report`: 显示 HDFS 的健康状态和容量信息。

  1. 文件系统操作

`hdfs dfs -ls [path]`: 列出指定路径下的文件和目录。

`hdfs dfs -du [path]`: 显示指定路径的文件和目录的大小。

`hdfs dfs -df [path]`: 显示 HDFS 的磁盘使用情况。

  1. 文件操作

`hdfs dfs -put localpath hdfspath`: 将本地文件上传到 HDFS。

`hdfs dfs -get hdfspath localpath`: 从 HDFS 下载文件到本地。

`hdfs dfs -copyFromLocal localpath hdfspath`: 将本地文件复制到 HDFS。

`hdfs dfs -copyToLocal hdfspath localpath`: 从 HDFS 复制文件到本地。

  1. 目录操作

`hdfs dfs -mkdir [path]`: 在 HDFS 中创建目录。

`hdfs dfs -rmdir [path]`: 删除 HDFS 中的空目录。

`hdfs dfs -rm [path]`: 删除 HDFS 中的文件或目录。

`hdfs dfs -rm -r [path]`: 递归删除 HDFS 中的目录及其内容。

  1. 文件查看

`hdfs dfs -cat [path]`: 显示 HDFS 文件的内容。

`hdfs dfs -tail [path]`: 显示 HDFS 文件的最后部分内容。

`hdfs dfs -chmod [permissions] [path]`: 更改 HDFS 文件或目录的权限。

`hdfs dfs -chown [owner:group] [path]`: 更改 HDFS 文件或目录的所有者和用户组。

`hdfs dfs -chgrp [group] [path]`: 更改 HDFS 文件或目录的用户组。

二、 MapReduce 命令

1. 提交作业

`hadoop jar [jarfile] [mainclass] [args]`: 提交一个 MapReduce 作业。

2. 查看作业状态

`yarn application -list`: 列出当前运行的 YARN 应用程序。

`yarn application -status [applicationId]`: 查看指定应用程序的状态。

3. 停止作业

`yarn application -kill [applicationId]`: 杀死指定的 YARN 应用程序。

这些命令是使用 Hadoop 时常用的基础命令。Hadoop 的文档和社区提供了更多的细节和高级用法,适用于具体的配置和操作需求。

相关推荐
初次攀爬者17 分钟前
Redis与数据库的数据一致性方案解析
数据库·redis·分布式
低调小一30 分钟前
OpenClaw 从安装到可用:把 Tools/Skills 变成“可控操控面板”,并用飞书做远程入口
java·大数据·人工智能·飞书·openclaw·clawbot·skil
八月瓜科技33 分钟前
擎策·知海全球专利数据库 凭差异化优势 筑科技创新检索壁垒
大数据·数据库·人工智能·科技·深度学习·机器人
职豚求职小程序1 小时前
东软集团题库笔试测评系统练习笔试2026新版
大数据·汇编·人工智能
切糕师学AI1 小时前
Kubernetes Operator 详解
运维·分布式·云原生·容器·kubernetes·自动化·运维自动化
LaughingZhu1 小时前
Product Hunt 每日热榜 | 2026-03-12
大数据·数据库·人工智能·经验分享·搜索引擎
梵得儿SHI1 小时前
Spring Cloud 高并发订单服务实战:从创建流程优化到 Seata 分布式事务落地(附代码 + 架构图)
分布式·spring·spring cloud·高并发·异步削峰·完整解决方案·限流降级
晨曦5432102 小时前
CentOS网络配置全解析:从ifconfig到实战
hadoop·虚拟机
几分醉意.2 小时前
先发制人:用 Bright Data 抢先捕捉 TikTok 爆款内容(附实战案例)
java·大数据·人工智能
袋鼠云数栈2 小时前
能源矿产行业 Data + AI 数智化全景解决方案——构建集团级智慧运营生产体系的系统路径
大数据·人工智能·能源·数据治理