Hadoop----Azkaban的使用与一些报错问题的解决

1.因为官方只放出源码,并没有放出其tar包,所以需要我们自己编译,通过查阅资料我们可以使用gradlew对其进行编译,还是比较简单,然后将里面需要用到的服务文件夹进行拷贝,完善其文件夹结构,通常会缺少几个,需要自己创建一个,然后再从其他目录中复制几个到目标服务。再配置各个服务的xml文件即可。

2.需要用到MySQL,需要创建azkaban数据库,在构建好的项目中,有一个sql脚本(带start字眼),在mysql中执行source命令即可导入。

3.启动Executor,在启动Web服务,在浏览默器中输入

https://node1:8443

node1为自己的启动机器,8443也是可以在xml中指定的,如果用配置ssl的key,可以使用https进行访问,弹出警告只需要点击已经了解风险即可访问网页:

4.在启动web服务时,会报错!

  1. Error injecting constructor, azkaban.executor.ExecutorManagerException: No active executor found

问题时已经启动了,executor为何会说不活跃?

需要多加一步,打开MySQL:

mysql -u root -p

输入密码进入mysql客户端,输入以下sql:

update azkaban.executors set active=1;

将数据库表中的active的值改为1则为active状态。

注意:在启动服务中,都会在对应的目录下生成日志文件,要去打开查看,才会知道有没有报错,如出现Java的异常报错如xxxException那就要去根据问题去找问题,去百度。

相关推荐
问道飞鱼32 分钟前
分布式中间件-Pika一个高效的分布式缓存组件
分布式·缓存·中间件
小宋10212 小时前
玩转RabbitMQ声明队列交换机、消息转换器
服务器·分布式·rabbitmq
江畔独步3 小时前
Hive内置集合函数-size,map_keys,map_values,sort_array,array_contains
数据仓库·hive·hadoop
天地风雷水火山泽3 小时前
二百六十五、Hive——目前Hive数仓各层表样例
数据仓库·hive·hadoop
棉花糖灬3 小时前
Hive常用函数
数据仓库·hive·hadoop
懒洋洋的华3697 小时前
消息队列-Kafka(概念篇)
分布式·中间件·kafka
March€8 小时前
分布式事务的基本实现
分布式
DieSnowK9 小时前
[Redis][环境配置]详细讲解
数据库·redis·分布式·缓存·环境配置·新手向·详细讲解
Lill_bin10 小时前
深入理解ElasticSearch集群:架构、高可用性与数据一致性
大数据·分布式·elasticsearch·搜索引擎·zookeeper·架构·全文检索
涛思数据(TDengine)11 小时前
TDengine 与 SCADA 强强联合:提升工业数据管理的效率与精准
大数据·时序数据库·tdengine