技术栈

ambari plus

TTBIGDATA
16 天前
大数据·hadoop·分布式·spark·ambari·sqoop·ambari plus
【Ambari Plus】13.Spark 安装Spark 是批处理、SQL、流处理和机器学习场景里很常用的计算引擎。本篇在已经安装 HDFS、YARN、Hive、Flink、Kafka 的基础上继续安装 Spark。
TTBIGDATA
22 天前
大数据·hadoop·ambari·hdp·cdh·bigtop·ambari plus
【Ambari Plus】06.MapReduce2 安装MapReduce2 在这套安装流程里不是单独再开一个向导安装,而是在选择 YARN 时被自动纳入依赖。页面会显示本次安装同时处理 YARN 和 MapReduce2,所以这一篇重点讲 MapReduce2 在同一向导里的角色分配和安装后确认。
TTBIGDATA
20 天前
大数据·hadoop·分布式·kafka·ambari·hdp·ambari plus
【Ambari Plus】11.Kafka 安装Kafka 用来承载消息发布订阅和流式数据管道。它依赖 ZooKeeper,本篇环境已经提前安装并启动了三节点 ZooKeeper,所以可以直接进入 Kafka 安装。
TTBIGDATA
20 天前
大数据·hadoop·ambari·hdp·sqoop·cdh·ambari plus
【Ambari Plus】08.Sqoop 安装Sqoop 主要用于关系型数据库和 Hadoop 生态之间的数据导入导出。它不像 HDFS、YARN 那样有常驻服务进程,本篇安装的核心动作是把 SQOOP Client 分发到目标主机,并下发 sqoop-env、sqoop-site 等客户端配置。
我是有底线的