【hadoop】远程调试环境

根据上一节,我们已经安装完成hadoop伪分布式环境

hadoop集群环境配置_jdk1.8 441-CSDN博客

还没安装的小伙伴可以看看这个帖子

这一节我们要实现使用vscode进行远程连接,并且完成java配置与测试


目录

vscode

配置远程

安装java插件

新建java项目

配置依赖

Java项目编译,打包,运行

打包为可执行JAR

运行JAR程序

Hadoop集群运行程序


vscode

上官网下载vscode(这里默认你已经安装)

然后配置插件

Remote-SSH

配置远程

点卡开之后会出现SSH(下面的图是已经使用过后的结果)

会弹出远程连接的提示

直接输入虚拟机的ip即可

安装java插件

连接完后,需要在远程机子上安装java插件

在vscode插件页面搜索

Extension Pack for Java

新建java项目

你可以新建文件夹后在文件夹下面新建项目

新建文件夹

打开终端

Ctrl+~
mkdir ~/workplace

调出命令框

ctrl+shift+p

然后输入java

点击

  • 选择 no bulid tools

  • 选择刚才创建的 workplace 文件夹

命名

然后就会给你创建一个默认简单java项目

包括这些

配置依赖

打开settings.json文件

根据具体位置配置,以下图片中包括文件查找,根据查找的路径进行更改

最终

Java项目编译,打包,运行

目录结构

HelloWorld/

├── src/

│ └── com/

│ └── demo/

│ └── hello/

│ └── HelloWorld.java

└── bin/
package com.demo.hello;

public class HelloWorld {

public static void main(String[] args) throws Exception {

System.out.println("Hello, World!");

}

}

vscode会自动创建编译的bin目录

咱们直接运行就行

复制代码
javac -d bin src/com/demo/hello/HelloWorld.java

打包为可执行JAR

jar cvfe hello-demo.jar com.demo.hello.HelloWorld -C bin .

验证结构

jar tf hello-demo.jar

输出应包含

META-INF/MANIFEST.MF

com/demo/hello/HelloWorld.class

运行JAR程序

复制代码
java -jar hello-demo.jar

Hadoop集群运行程序

注意,这里要先启动hadoop集群

不然会出现如下错误

在终端运行

然后,准备hadoop环境

hdfs dfs -mkdir -p /input
hdfs dfs -put LICENSE.txt /input

会报错

检查文件(在常见位置)

复制代码
ls /usr/share/doc/*/LICENSE.txt
ls ~/Downloads/LICENSE.txt

查找Hadoop安装目录下的LICENSE文件(可能需要root权限)

复制代码
find $HADOOP_HOME -name "LICENSE*" 2>/dev/null

上传

复制代码
cp $HADOOP_HOME/LICENSE.txt .

继续运行

hdfs dfs -put LICENSE.txt /input

解决

继续

hdfs dfs -rm -r /output/res # 确保输出目录不存在

提交作业

hadoop jar hello-demo.jar MR_Sample.WordCount.WordCountMain /input/LICENSE.txt /output/res

ok!

相关推荐
赵渝强老师1 小时前
【赵渝强老师】大数据日志采集引擎Flume
大数据·flume
TDengine (老段)2 小时前
TDengine 数据函数 ROUND 用户手册
java·大数据·数据库·物联网·时序数据库·tdengine·1024程序员节
TDengine (老段)2 小时前
TDengine 数学函数 RAND 用户手册
java·大数据·数据库·物联网·时序数据库·tdengine·涛思数据
Web3_Daisy2 小时前
冷换仓的隐性代价:从安全策略到地址信誉体系的重新思考
大数据·安全·web3·区块链·比特币·1024程序员节
WLJT1231231233 小时前
生活电器:重构家居体验的产业变革与发展探索
大数据·人工智能·科技·生活
大叔_爱编程4 小时前
基于随机森林算法的Boss直聘数据分析及可视化-hadoop+django+spider
hadoop·django·1024程序员节·spider·随机森林算法·boss直聘
GIS数据转换器4 小时前
城市基础设施安全运行监管平台
大数据·运维·人工智能·物联网·安全·无人机·1024程序员节
老葱头蒸鸡4 小时前
(3)Kafka生产者分区策略、ISR、ACK、一致性语义
分布式·kafka
搞科研的小刘选手4 小时前
【云计算专题会议】第二届云计算与大数据国际学术会议(ICCBD 2025)
大数据·人工智能·物联网·5g·云计算·6g·智能通信
电商软件开发 小银4 小时前
微信生态新机遇:视频号推客模式助力商家突围
大数据·人工智能·twitter·系统开发·实体店转型·数字化经济·视频号推客模式