Hadoop----Azkaban的使用与一些报错问题的解决

1.因为官方只放出源码,并没有放出其tar包,所以需要我们自己编译,通过查阅资料我们可以使用gradlew对其进行编译,还是比较简单,然后将里面需要用到的服务文件夹进行拷贝,完善其文件夹结构,通常会缺少几个,需要自己创建一个,然后再从其他目录中复制几个到目标服务。再配置各个服务的xml文件即可。

2.需要用到MySQL,需要创建azkaban数据库,在构建好的项目中,有一个sql脚本(带start字眼),在mysql中执行source命令即可导入。

3.启动Executor,在启动Web服务,在浏览默器中输入

https://node1:8443

node1为自己的启动机器,8443也是可以在xml中指定的,如果用配置ssl的key,可以使用https进行访问,弹出警告只需要点击已经了解风险即可访问网页:

4.在启动web服务时,会报错!

  1. Error injecting constructor, azkaban.executor.ExecutorManagerException: No active executor found

问题时已经启动了,executor为何会说不活跃?

需要多加一步,打开MySQL:

mysql -u root -p

输入密码进入mysql客户端,输入以下sql:

update azkaban.executors set active=1;

将数据库表中的active的值改为1则为active状态。

注意:在启动服务中,都会在对应的目录下生成日志文件,要去打开查看,才会知道有没有报错,如出现Java的异常报错如xxxException那就要去根据问题去找问题,去百度。

相关推荐
TDengine (老段)4 小时前
TDengine 中的关联查询
大数据·javascript·网络·物联网·时序数据库·tdengine·iotdb
直裾8 小时前
Mapreduce的使用
大数据·数据库·mapreduce
低头不见10 小时前
一个服务器算分布式吗,分布式需要几个服务器
运维·服务器·分布式
麻芝汤圆10 小时前
使用 MapReduce 进行高效数据清洗:从理论到实践
大数据·linux·服务器·网络·数据库·windows·mapreduce
树莓集团11 小时前
树莓集团海南落子:自贸港布局的底层逻辑
大数据
不剪发的Tony老师11 小时前
Hue:一个大数据查询工具
大数据
靠近彗星11 小时前
如何检查 HBase Master 是否已完成初始化?| 详细排查指南
大数据·数据库·分布式·hbase
墨染丶eye11 小时前
数据仓库项目启动与管理
大数据·数据仓库·spark
SelectDB11 小时前
Apache Doris 2025 Roadmap:构建 GenAI 时代实时高效统一的数据底座
大数据·数据库·aigc
遇到困难睡大觉哈哈12 小时前
Git推送错误解决方案:`rejected -> master (fetch first)`
大数据·git·elasticsearch