hadoop集群环境搭建和常用命令

搭建过程

1.集群配置

cat /etc/hosts

2.步骤安装 Java是否安装

which java 或者 echo $JAVA_HOME

3.解压安装包

tar -zxvf

4.修改配置文件

cd $HADOOP_HOME/etc/hadoop/

下面是需要修改的配置文件

hadoop-env.sh

yarn-env.sh

hdfs-site.xml

core-site.xml

mapred-site.xml

yarn-site.xml

5.配置环境变量(面试点! 两种修改配置的命令有什么区别)

vim ~./bashrc 用户级别的

vim /etc/profile 全局生效的

6.刷新环境变量

复制代码
source ~./bashrc

master环境变量拷贝到 slave1中,同时master和slave之间要进行两两免密登录(最好配置用户级别的)

scp -rp ~./bashrc  root@slave1:/root/.bashrc

scp -rp ~./bashrc  root@slave2:/root/.bashrc

7.拷贝安装包

8.集群启动

#初始化NameNode

hadoop namenode -format

#启动/停止

python 复制代码
 sh  $HADOOP_HOME/sbin/start-all.sh 

  sh  $HADOOP_HOME/sbin/stop-all.sh 

9.验证

jps

常用命令

  1. 查看根目录 hadoop fs -ls /

  2. 创建多级文件夹 hadoop fs -mkdir -p /bd_29/aa/bb

  3. 查看文件路径 pwd

  4. 创建文件 touch

  5. 查看历史输入命令 history

  6. 删除全部已有命令 ctrl + u

  7. 快速回到第一个位置 Ctrl + a

  8. 关闭安全模式 hadoop dfsadmin -safemode leave

  9. 查看硬盘空间 df -h

查看文件大小 du -sh * : 查看各个文件的大小

  1. 上传文件 hadoop fs -put 当前文件路径 目标文件路径

  2. 查看文件内容 hadoop fs -cat(text/tail) b.txt

    查看文件内容前十行 hadoop fs -cat b.txt | head -10

    查看文件大小 hadoop fs -du -s -h /test/a.txt

    查看内容行数 hadoop fs -cat /b.txt | wc -l

    查看文件个数 hadoop fs -ls /b.txt | wc -l

  3. 查看最近被修改的文件 ll -rt

  4. 查看隐藏的目录或者文件 ls -la

  5. -rm -rf 使用之前先pwd ,删除必须指定文件名

  6. :q! 强制退出

    history 查看历史命令 history | grep move

  7. vim中的常用命令

    :set number 显示行号

    :/HADOOP 查找关键字 HADOOP

    gg 快速回到文件开始

    shift + g 快速回到文件末尾

    %s/ a /b / g 将 a 替换成 b

    g+d 高亮单词

  8. 查看内容行数 hadoop fs -cat(text/tail) /bd_29/b.txt | wc -l

  9. 查看文件数量 hadoop fs -ls /bd_29/b.txt | wc -l

  10. 下载文件 hadoop fs -get /bd_29/b.txt .

  11. 删除文件放入回收站 hadoop fs -rmr /bd_29/

相关推荐
陈奕昆11 分钟前
n8n实战营Day3:电商订单全流程自动化·需求分析与流程拆解
大数据·开发语言·人工智能·自动化·需求分析·n8n
代码改善世界19 分钟前
【探索实战】从零到一:Kurator 构建分布式云原生平台的探索与实践
分布式·云原生
semantist@语校43 分钟前
第五十一篇|构建日本语言学校数据模型:埼玉国际学院的城市结构与行为变量分析
java·大数据·数据库·人工智能·百度·ai·github
赵渝强老师1 小时前
【赵渝强老师】阿里云大数据集成开发平台DataWorks
大数据·阿里云·云计算
9***Y481 小时前
后端在分布式中的Apache Kafka
分布式·kafka
xieyan08111 小时前
卖出与止损策略
大数据
yumgpkpm1 小时前
腾讯TBDS和Cloud Data AI CMP 比较的缺陷在哪里?
hive·hadoop·elasticsearch·zookeeper·spark·kafka·hbase
Elastic 中国社区官方博客1 小时前
使用 LangChain 和 Elasticsearch 开发一个 agentic RAG 助手
大数据·人工智能·elasticsearch·搜索引擎·ai·langchain·全文检索
z***02601 小时前
Python大数据可视化:基于大数据技术的共享单车数据分析与辅助管理系统_flask+hadoop+spider
大数据·python·信息可视化
知识分享小能手1 小时前
openEuler入门学习教程,从入门到精通,openEuler 24.03 环境下 Hadoop 全面实践指南(19)
大数据·hadoop·openeuler