技术栈

ambari plus

TTBIGDATA
1 个月前
大数据·hadoop·分布式·spark·ambari·sqoop·ambari plus
【Ambari Plus】13.Spark 安装Spark 是批处理、SQL、流处理和机器学习场景里很常用的计算引擎。本篇在已经安装 HDFS、YARN、Hive、Flink、Kafka 的基础上继续安装 Spark。
TTBIGDATA
1 个月前
大数据·hadoop·ambari·hdp·cdh·bigtop·ambari plus
【Ambari Plus】06.MapReduce2 安装MapReduce2 在这套安装流程里不是单独再开一个向导安装,而是在选择 YARN 时被自动纳入依赖。页面会显示本次安装同时处理 YARN 和 MapReduce2,所以这一篇重点讲 MapReduce2 在同一向导里的角色分配和安装后确认。
TTBIGDATA
1 个月前
大数据·hadoop·分布式·kafka·ambari·hdp·ambari plus
【Ambari Plus】11.Kafka 安装Kafka 用来承载消息发布订阅和流式数据管道。它依赖 ZooKeeper,本篇环境已经提前安装并启动了三节点 ZooKeeper,所以可以直接进入 Kafka 安装。
TTBIGDATA
1 个月前
大数据·hadoop·ambari·hdp·sqoop·cdh·ambari plus
【Ambari Plus】08.Sqoop 安装Sqoop 主要用于关系型数据库和 Hadoop 生态之间的数据导入导出。它不像 HDFS、YARN 那样有常驻服务进程,本篇安装的核心动作是把 SQOOP Client 分发到目标主机,并下发 sqoop-env、sqoop-site 等客户端配置。
我是有底线的