Hadoop开发环境搭建

第一关 配置开发环境 - JavaJDK的配置

按顺序输入运行即可

java 复制代码
apt remove -y openjdk-8-jdk
apt autoremove -y
cd /opt
wget https://repo.huaweicloud.com/java/jdk/8u171-b11/jdk-8u171-linux-x64.tar.gz
tar -zxvf jdk-8u171-linux-x64.tar.gz
mkdir -p /app
mv jdk1.8.0_171 /app/
sed -i '/JAVA_HOME/d' /etc/profile
echo "export JAVA_HOME=/app/jdk1.8.0_171" >> /etc/profile
echo 'export PATH=$JAVA_HOME/bin:$PATH' >> /etc/profile
source /etc/profile
java -version

第二关 配置开发环境 - Hadoop安装与伪分布式集群搭建

注意:#后的为注释,请不要复制到命令行,按顺序输入代码部分即可。

java 复制代码
# ==================== 1. 解压安装 ====================
cd /opt
tar -zxvf hadoop-3.1.0.tar.gz
mkdir -p /app
mv hadoop-3.1.0 /app/hadoop

# ==================== 2. SSH 免密登录 ====================
ssh-keygen -t rsa -P '' -f ~/.ssh/id_rsa
cat ~/.ssh/id_rsa.pub >> ~/.ssh/authorized_keys
chmod 600 ~/.ssh/authorized_keys

# ==================== 3. 配置 Hadoop 环境变量 ====================
cd /app/hadoop/etc/hadoop
echo 'export JAVA_HOME=/app/jdk1.8.0_171' >> hadoop-env.sh
echo 'export JAVA_HOME=/app/jdk1.8.0_171' >> yarn-env.sh

# ==================== 4. 配置 core-site.xml ====================
cat > core-site.xml << 'EOF'
<configuration>
    <property>
        <name>fs.defaultFS</name>
        <value>hdfs://localhost:9000</value>
    </property>
    <property>
        <name>hadoop.tmp.dir</name>
        <value>/usr/hadoop/tmp</value>
    </property>
</configuration>
EOF

# ==================== 5. 配置 hdfs-site.xml ====================
cat > hdfs-site.xml << 'EOF'
<configuration>
    <property>
        <name>dfs.namenode.name.dir</name>
        <value>/usr/hadoop/hdfs/name</value>
    </property>
    <property>
        <name>dfs.datanode.data.dir</name>
        <value>/usr/hadoop/hdfs/data</value>
    </property>
    <property>
        <name>dfs.replication</name>
        <value>1</value>
    </property>
</configuration>
EOF

# ==================== 6. 配置 mapred-site.xml ====================
cp mapred-site.xml.template mapred-site.xml
cat > mapred-site.xml << 'EOF'
<configuration>
    <property>
        <name>mapreduce.framework.name</name>
        <value>yarn</value>
    </property>
</configuration>
EOF

# ==================== 7. 配置 yarn-site.xml ====================
cat > yarn-site.xml << 'EOF'
<configuration>
    <property>
        <name>yarn.nodemanager.aux-services</name>
        <value>mapreduce_shuffle</value>
    </property>
</configuration>
EOF

# ==================== 8. 创建数据目录 ====================
mkdir -p /usr/hadoop/tmp
mkdir -p /usr/hadoop/hdfs/data
mkdir -p /usr/hadoop/hdfs/name

# ==================== 9. 配置系统环境变量 ====================
echo 'export HADOOP_HOME=/app/hadoop' >> /etc/profile
echo 'export PATH=$HADOOP_HOME/bin:$HADOOP_HOME/sbin:$PATH' >> /etc/profile
source /etc/profile

# ==================== 10. 修改启动脚本(root用户) ====================
cd /app/hadoop/sbin
sed -i '1iHDFS_DATANODE_USER=root\nHDFS_NAMENODE_USER=root\nHDFS_SECONDARYNAMENODE_USER=root' start-dfs.sh
sed -i '1iHDFS_DATANODE_USER=root\nHDFS_NAMENODE_USER=root\nHDFS_SECONDARYNAMENODE_USER=root' stop-dfs.sh
sed -i '1iYARN_RESOURCEMANAGER_USER=root\nYARN_NODEMANAGER_USER=root' start-yarn.sh
sed -i '1iYARN_RESOURCEMANAGER_USER=root\nYARN_NODEMANAGER_USER=root' stop-yarn.sh

# ==================== 11. 格式化 HDFS ====================
hadoop namenode -format
# 如果提示输入,输入 Y 确认

# ==================== 12. 启动 Hadoop ====================
start-dfs.sh
start-yarn.sh

# ==================== 13. 验证安装 ====================
jps
相关推荐
AI星桥小王子1 小时前
支持人物一致性的 AI 视频生成方案分享:怎么能解决 “人脸漂移” 痛点
大数据·人工智能
数智化管理手记2 小时前
手工统计指标误差大、效率低?指标管理系统如何告别人工算数痛点?
大数据·运维·数据库·人工智能·云计算
ShiXZ2138 小时前
Redis 常用指令全集:redis-cli 实战速查手册
数据库·redis·缓存
晓子文集9 小时前
Tushare接口文档:期货日线行情(fut_daily)
大数据·数据库·金融数据·量化投资·tushare
FII工业富联科技服务9 小时前
工业设备运维如何Agentic化?拆解Factory Brain的设备运维架构
大数据·运维·人工智能·架构·制造
WA内核拾荒者9 小时前
WhatsApp 账号异常检测的自动化告警系统设计
数据库·python·自动化
qq295310 小时前
2026 财搭子决策模拟器:多智能体投研架构能力拆解
大数据·人工智能·架构
Ai拆代码的曹操12 小时前
Git 集成:AI 代理中的版本控制工作流设计
大数据·git·elasticsearch
龙仔72513 小时前
人大金仓OS_Core数据库自动备份实施笔记(银河麒麟Linux)
linux·数据库·笔记·备份·人大金仓
lazy H13 小时前
Git clone 怎么用?克隆项目及常见问题完整教程
大数据·git·后端·学习·搜索引擎·github