spark集成hive

集群使用ambari+hdp方式进行部署,集群的相关版本号如下所示:

ambari版本

Version 2.7.4.0

HDP版本

HDP-3.1.4.0

hive版本

3.1.0

spark版本

2.3.0

集群前提条件:

1.Hdp、Spark、Hive都已部署好

2.Hive数据层建好,在Hdfs生成相应各层目录,后面配置Spark访问Hive的目录,要保证这个目录存在。

spark集成hive

1.修改spark配置: Advanced spark2-defaults

spark.sql.warehouse.dir将默认值/apps/spark/warehouse 改为hive数据存储hdfs位置

/warehouse/tablespace/managed/hive

2.修改spark配置: Advanced spark2-hive-site-overrid

metastore.catalog.default 值 spark 改为 hive

  1. 修改hive配置: 到hive组件修改配置

hive.strict.managed.tables 的 true 改为 false

相关推荐
maozexijr1 小时前
Flink 的水印机制
大数据·flink
maozexijr1 小时前
什么是 Flink Pattern
大数据·python·flink
moongoblin1 小时前
协作赋能-1-制造业生产流程重构
大数据·人工智能·经验分享·制造
小伍_Five2 小时前
spark数据处理练习题详解【上】
java·开发语言·spark·scala
后端码匠2 小时前
【Hadoop】伪分布式安装
大数据·hadoop·分布式
IvanCodes3 小时前
MySQL 数据库备份与还原
大数据·数据库·sql·mysql
Freedom℡5 小时前
Spark,连接MySQL数据库,添加数据,读取数据
数据库·hadoop·spark
小伍_Five5 小时前
spark数据处理练习题详解【下】
java·大数据·spark·scala
你的坚持终将美好,5 小时前
elasticsearch kibana ik 各版本下载
大数据·elasticsearch·搜索引擎
Pluto_CSND6 小时前
hbase shell的常用命令
大数据·数据库·hbase