Storm实时流式计算系统(全解)——上

storm 实时流式计算系统的工作机制

官方网址:http://storm.apache.org/t

Apache Storm 是一个免费、开源的分布式实时计算系统。使用它可以轻松实现数据流的实时

处理。Strom很简单,可以用任何编程语言!

Storm 用例:实时在线分析,机器学习,连续计算,分布式 RPC,ETL 等。

Strom特点:

快速:基准时钟在超过一百万元组每秒处理的每个节点。

简易的设置:有可扩展性、容错性,保证了数据的处理能力,并且易于设置和操作。

storm集群的配置和部署

配置文件修改

配置好主机器后,复制到两个子节点机器上,启动zk,检查一下

检查zk的状态和存储,查看后qult退出来。

启动nimbus,并且查看其进程,但是由于是前台启动,无法cv关闭,所有要重新克隆一个窗口去查看进程

启动supervisor,并且查看其进程,但是由于是前台启动,无法cv关闭,所有要重新克隆一个窗空去查看进程

启动网页服务,用于网友打开,该程序在nimbus服务器上启动,但是由于是前台启动,无法cv关闭,所有要重新克隆一个窗空去查看进程

使用页面查看集群情况

storm集群的部署及动态增加节点

配置添加work数量,(supvison是从节点,内部的work才是正在做事的程序)。3个都修改后。

后台启动进程。(以下是启动主节点进程和从节点进程),以及UI界面的方法

启动后验证。01上启动nimbus,01/02/03都启动supervsion后的节点每个里面游个槽点work修改是否正确

相关推荐
maozexijr4 分钟前
Flink 的任务槽和槽共享
大数据·flink
问道飞鱼1 小时前
【大数据知识】今天聊聊Clickhouse部署方案
大数据·clickhouse·部署
金融小师妹4 小时前
应用BERT-GCN跨模态情绪分析:贸易缓和与金价波动的AI归因
大数据·人工智能·算法
武子康4 小时前
大语言模型 10 - 从0开始训练GPT 0.25B参数量 补充知识之模型架构 MoE、ReLU、FFN、MixFFN
大数据·人工智能·gpt·ai·语言模型·自然语言处理
睎zyl8 小时前
Spark自定义分区器-基础
大数据·分布式·spark
巨龙之路8 小时前
【TDengine源码阅读】DLL_EXPORT
大数据·时序数据库·tdengine
元6339 小时前
搭建spark-local模式
大数据·spark
巨龙之路9 小时前
TDengine编译成功后的bin目录下的文件的作用
大数据·时序数据库·tdengine
莫叫石榴姐10 小时前
大模型在数据分析领域的研究综述
大数据·数据挖掘·数据分析
百锦再10 小时前
大数据技术的主要方向及其应用详解
大数据·linux·网络·python·django·pygame