大数据笔记之 Hadoop 常用 Shell 命令(一)

文章目录

  • 前言
  • 一、HDFS上的操作
    • [1.1 查看文件或文件夹](#1.1 查看文件或文件夹)
    • [1.2 修改文件或目录权限](#1.2 修改文件或目录权限)
    • [1.3 创建或删除文件夹](#1.3 创建或删除文件夹)
    • [1.4 移动或创建文件](#1.4 移动或创建文件)
    • [1.5 信息统计](#1.5 信息统计)
    • [1.6 设置 hdfs 中文件的副本数量](#1.6 设置 hdfs 中文件的副本数量)
  • 二、在本地上传或下载的操作
    • [2.1 从本地上传文件到HDFS](#2.1 从本地上传文件到HDFS)
    • [2.2 从HDFS下载文件到本地](#2.2 从HDFS下载文件到本地)
  • 总结

前言

前无言


一、HDFS上的操作

操作HDFS上的shell命令,与Linux命令使用方法类似

1.1 查看文件或文件夹

powershell 复制代码
# -ls 显示目录信息
hdfs dfs -ls /

# 显示文件内容
hdfs dfs -cat /tmp/k.txt

# 显示文件末尾 1kb 的数据
hdfs dfs -tail /tmp/x.txt

1.2 修改文件或目录权限

powershell 复制代码
# 修改文件或目录权限
hadoop fs -chmod 777 /a.txt

# 修改文件或目录所有者和所属的组
hadoop fs -chown hadoop:hadoop /a

# 修改文件或目录所属组
hadoop fs -chgrp hadoop /a.txt

1.3 创建或删除文件夹

powershell 复制代码
# 创建文件夹
hdfs dfs -mkdir /a

# 递归创建文件夹
hdfs dfs -mkdir -p /a/b/c

# 删除文件
hdfs dfs -rm /a/b/k.txt

# 递归删除目录及目录里的内容(慎用)
hdfs dfs -rm -r /a

1.4 移动或创建文件

powershell 复制代码
# 移动文件
hdfs dfs -mv /a/k.txt /b

# 创建文件
hdfs dfs -touch /m/w.txt

1.5 信息统计

powershell 复制代码
# 统计文件夹的大小信息
hdfs dfs -du -s -h /a
hdfs dfs -du -h /a

1.6 设置 hdfs 中文件的副本数量

powershell 复制代码
hdfs dfs -setrep 5 /a/k.txt

二、在本地上传或下载的操作

2.1 从本地上传文件到HDFS

powershell 复制代码
 # 从本地剪切粘贴到HDFS
hdfs dfs -moveFromLocal tmp.txt /tmp

# 从本地文件系统中拷贝文件到HDFS上去
hdfs dfs -copyFromLocal tmp.txt /tmp

# 从本地文件系统中拷贝文件到HDFS上去(常用)
 hdfs dfs -put tmp.txt /tmp
 
 # 追加一个文件到已经存在的文件末尾
hdfs dfs -appendToFile tmp.txt /tmp/b.txt

2.2 从HDFS下载文件到本地

powershell 复制代码
# 从HDFS拷贝到本地
hdfs dfs -copyToLocal /tmp/b.txt /home

# 等同于copyToLocal (常用)
hdfs dfs -get /tmp/b.txt /home

总结

没了。。。

相关推荐
老蒋新思维16 小时前
创客匠人:当知识IP遇上系统化AI,变现效率如何实现阶跃式突破?
大数据·网络·人工智能·网络协议·tcp/ip·重构·创客匠人
天远云服16 小时前
Go 语言实战:手撸 AES-128-CBC 加密,对接天远金融风控 API
大数据·服务器·网络·golang
运维行者_16 小时前
不同规模企业如何选 OPM?参考局域网管理软件与 cpu 温度监控适配指南
大数据·运维·服务器·网络·数据库·postgresql·snmp
是阿威啊17 小时前
【第六站】测试本地项目连接虚拟机上的大数据集群
大数据·linux·hive·hadoop·spark·yarn
老徐电商数据笔记17 小时前
技术复盘第八篇:从“数据烟囱”到“能力引擎”:中型电商数仓重构实战手册
大数据·数据仓库·重构·数据中台·用户画像·技术面试
数据皮皮侠AI17 小时前
数字经济政策工具变量数据(2008-2023)
大数据·数据库·人工智能·笔记·1024程序员节
雷焰财经17 小时前
iBox探索文化产业数字化路径:标准筑基 生态赋能
大数据·人工智能
zhongtianhulian17 小时前
陶瓷行业大会资讯:掌握行业动态,洞察未来趋势
大数据·人工智能·python
Francek Chen17 小时前
【IoTDB】时序数据库选型指南:国产自研技术如何应对数据洪流
大数据·数据库·时序数据库·iotdb
做cv的小昊17 小时前
【TJU】信息检索与分析课程笔记和练习(4)中文文献检索—CNKI
大数据·经验分享·笔记·学习·信息可视化·全文检索·信息检索