Hadoop----Azkaban的使用与一些报错问题的解决

1.因为官方只放出源码,并没有放出其tar包,所以需要我们自己编译,通过查阅资料我们可以使用gradlew对其进行编译,还是比较简单,然后将里面需要用到的服务文件夹进行拷贝,完善其文件夹结构,通常会缺少几个,需要自己创建一个,然后再从其他目录中复制几个到目标服务。再配置各个服务的xml文件即可。

2.需要用到MySQL,需要创建azkaban数据库,在构建好的项目中,有一个sql脚本(带start字眼),在mysql中执行source命令即可导入。

3.启动Executor,在启动Web服务,在浏览默器中输入

https://node1:8443

node1为自己的启动机器,8443也是可以在xml中指定的,如果用配置ssl的key,可以使用https进行访问,弹出警告只需要点击已经了解风险即可访问网页:

4.在启动web服务时,会报错!

  1. Error injecting constructor, azkaban.executor.ExecutorManagerException: No active executor found

问题时已经启动了,executor为何会说不活跃?

需要多加一步,打开MySQL:

mysql -u root -p

输入密码进入mysql客户端,输入以下sql:

update azkaban.executors set active=1;

将数据库表中的active的值改为1则为active状态。

注意:在启动服务中,都会在对应的目录下生成日志文件,要去打开查看,才会知道有没有报错,如出现Java的异常报错如xxxException那就要去根据问题去找问题,去百度。

相关推荐
Hsu_kk24 分钟前
Hive 查询用户连续三天登录的所有记录
数据仓库·hive·hadoop
yx9o27 分钟前
Kafka 源码 KRaft 模式本地运行
分布式·kafka
ycsdn1032 分钟前
Caused by: org.apache.flink.api.common.io.ParseException: Row too short:
大数据·flink
Gemini19951 小时前
分布式和微服务的区别
分布式·微服务·架构
G丶AEOM1 小时前
分布式——BASE理论
java·分布式·八股
DolphinScheduler社区2 小时前
Apache DolphinScheduler + OceanBase,搭建分布式大数据调度平台的实践
大数据
时差9533 小时前
MapReduce 的 Shuffle 过程
大数据·mapreduce
kakwooi4 小时前
Hadoop---MapReduce(3)
大数据·hadoop·mapreduce
数新网络4 小时前
《深入浅出Apache Spark》系列②:Spark SQL原理精髓全解析
大数据·sql·spark
windy1a4 小时前
【c知道】Hadoop工作原理。
hadoop