利用外部Postgresql及zookeeper,启动Apache Dolphinscheduler3.1.9

Apache DolphinScheduler 是一个分布式易扩展的可视化DAG工作流任务调度开源系统。适用于企业级场景,提供了一个可视化操作任务、工作流和全生命周期数据处理过程的解决方案。

Apache DolphinScheduler 旨在解决复杂的大数据任务依赖关系,并为应用程序提供数据和各种 OPS 编排中的关系。 解决数据研发ETL依赖错综复杂,无法监控任务健康状态的问题。 DolphinScheduler 以 DAG(Directed Acyclic Graph,DAG)流式方式组装任务,可以及时监控任务的执行状态,支持重试、指定节点恢复失败、暂停、恢复、终止任务等操作。

模块介绍

dolphinscheduler-master master模块,提供工作流管理和编排服务。

dolphinscheduler-worker worker模块,提供任务执行管理服务。

dolphinscheduler-alert 告警模块,提供 AlertServer 服务。

dolphinscheduler-api web应用模块,提供 ApiServer 服务。

dolphinscheduler-common 通用的常量枚举、工具类、数据结构或者基类

dolphinscheduler-dao 提供数据库访问等操作。

dolphinscheduler-extract extract模块,包含master/worker/alert的sdk

dolphinscheduler-service service模块,包含Quartz、Zookeeper、日志客户端访问服务,便于server模块和api模块调用

dolphinscheduler-ui 前端模块

1.环境

CPU:Hygon C86 7285 32-core Processor

操作系统:麒麟操作系统

Docker版本:28.2.2

Docker compose版本:2.37.2

Dolphinscheduler版本:3.1.9

​​​​​​​1.1网络要求

DolphinScheduler正常运行提供如下的网络端口配置:

|----------------------|--------------|-------------------|
| 组件 | 默认端口 | 说明 |
| MasterServer | 5678 | 非通信端口,只需本机端口不冲突即可 |
| WorkerServer | 1234 | 非通信端口,只需本机端口不冲突即可 |
| ApiApplicationServer | 12345 | 提供后端通信端口 |

2.docker版本的postgresql

docker exec -it postgis /bin/sh

#cd /var/lib/postgresql/data

#mkdir dss

chown -R postgres:postgres /var/lib/postgresql/data/dss

2.1创建数据库及用户

在postgresql中执行

----创建表空间

CREATE TABLESPACE dss_space

OWNER postgres

LOCATION '/var/lib/postgresql/data/dss';

//对应docker中的文件路径 /var/lib/postgresql/data

ALTER TABLESPACE dss_space

OWNER TO postgres;

----创建数据库

CREATE DATABASE dss

WITH

OWNER = postgres

TEMPLATE = template0

ENCODING = 'UTF8'

LC_COLLATE = 'C'

LC_CTYPE = 'C'

TABLESPACE = dss_space

CONNECTION LIMIT = -1;

---创建用户及赋权限

CREATE USER dss WITH PASSWORD 'Sinops1234~';

GRANT ALL PRIVILEGES ON DATABASE dss TO dss;

GRANT ALL PRIVILEGES ON all tables in schema public TO dss;

2.2导入表结构

表结构地址,表结构

​​​​​​​3.启动zookeeper容器

docker run --privileged=true -itd --name zookeeper -p 2181:2181 -e TZ=Asia/Shanghai zookeeper:3.9.3

4.启动dolphinscheduler-standalone-server

docker run --privileged=true -itd --name dss -p 12345:12345 -p 25333:25333 -e DATABASE="postgresql" -e SPRING_DATASOURCE_URL="jdbc:postgresql://192.168.1.4:5432/dss" -e SPRING_DATASOURCE_USERNAME="dss" -e SPRING_DATASOURCE_PASSWORD="Sinops1234~" -e SPRING_JACKSON_TIME_ZONE="UTC" -e TZ=Asia/Shanghai -e dss_ZOOKEEPER_CONNECT_STRING="192.168.1.5:2181" apache/dolphinscheduler-standalone-server:3.1.9

5. 界面

相关推荐
大厂技术总监下海10 小时前
数据湖加速、实时数仓、统一查询层:Apache Doris 如何成为现代数据架构的“高性能中枢”?
大数据·数据库·算法·apache
a努力。10 小时前
国家电网Java面试被问:最小生成树的Kruskal和Prim算法
java·后端·算法·postgresql·面试·linq
l1t11 小时前
NineData第三届数据库编程大赛:用一条 SQL 解数独问题我的参赛程序
数据库·人工智能·sql·算法·postgresql·oracle·数独
前端不太难13 小时前
从本地到多端:HarmonyOS 分布式数据管理实战详解
分布式·状态模式·harmonyos
Yeats_Liao13 小时前
MindSpore开发之路(二十五):融入开源:如何为MindSpore社区贡献力量
人工智能·分布式·深度学习·机器学习·华为·开源
鸠摩智首席音效师14 小时前
如何在 Apache 中排除特定的代理 URL 请求 ?
apache
我爱娃哈哈15 小时前
SpringBoot + Seata + Nacos:分布式事务落地实战,订单-库存一致性全解析
spring boot·分布式·后端
掘金-我是哪吒17 小时前
Kafka配套的Zookeeper启动脚本
分布式·zookeeper·云原生·kafka
利兄的视界17 小时前
一步到位:M4 芯片 Mac 安装 PostgreSQL 16 并适配 pgvector 教程
后端·postgresql
超级种码17 小时前
Kafka四部曲之一:Kafka的核心概念
分布式·kafka