技术栈
ambari plus
TTBIGDATA
16 天前
大数据
·
hadoop
·
分布式
·
spark
·
ambari
·
sqoop
·
ambari plus
【Ambari Plus】13.Spark 安装
Spark 是批处理、SQL、流处理和机器学习场景里很常用的计算引擎。本篇在已经安装 HDFS、YARN、Hive、Flink、Kafka 的基础上继续安装 Spark。
TTBIGDATA
22 天前
大数据
·
hadoop
·
ambari
·
hdp
·
cdh
·
bigtop
·
ambari plus
【Ambari Plus】06.MapReduce2 安装
MapReduce2 在这套安装流程里不是单独再开一个向导安装,而是在选择 YARN 时被自动纳入依赖。页面会显示本次安装同时处理 YARN 和 MapReduce2,所以这一篇重点讲 MapReduce2 在同一向导里的角色分配和安装后确认。
TTBIGDATA
20 天前
大数据
·
hadoop
·
分布式
·
kafka
·
ambari
·
hdp
·
ambari plus
【Ambari Plus】11.Kafka 安装
Kafka 用来承载消息发布订阅和流式数据管道。它依赖 ZooKeeper,本篇环境已经提前安装并启动了三节点 ZooKeeper,所以可以直接进入 Kafka 安装。
TTBIGDATA
20 天前
大数据
·
hadoop
·
ambari
·
hdp
·
sqoop
·
cdh
·
ambari plus
【Ambari Plus】08.Sqoop 安装
Sqoop 主要用于关系型数据库和 Hadoop 生态之间的数据导入导出。它不像 HDFS、YARN 那样有常驻服务进程,本篇安装的核心动作是把 SQOOP Client 分发到目标主机,并下发 sqoop-env、sqoop-site 等客户端配置。
我是有底线的