【Hive】Linux(CentOS7)下安装Hive教程

一、实验环境

1. 节点IP

主机名 IP
feilink1 192.168.10.101
feilink2 192.168.10.102
feilink3 192.168.10.103

2. 依赖组件

  • Hadoop
  • MySQL

3. 没有特殊说明的都是在feilink1节点上的操作

4. MySQL配置

  • 用户:root

  • 密码:123456

    5. 各组件版本

    组件 版本
    CentOS 7
    Hadoop 3.3.4
    MySQL 8.0.29

    6. 用户密码

    • root(123456)
    • hadoop(hadoop)

二、配置Hadoop

bash 复制代码
vim /export/server/hadoop/etc/hadoop/core-site.xml

添加以下内容

xml 复制代码
<property>
    <!-- Hive用到的代理 -->
    <name>hadoop.proxyuser.hadoop.hosts</name>
    <value>*</value>
</property>
<property>
    <name>hadoop.proxyuser.hadoop.groups</name>
    <value>*</value>
</property>

分发文件

bash 复制代码
scp /export/server/hadoop/etc/hadoop/core-site.xml feilink2:/export/server/hadoop/etc/hadoop/core-site.xml

scp /export/server/hadoop/etc/hadoop/core-site.xml feilink3:/export/server/hadoop/etc/hadoop/core-site.xml

三、下载Hive压缩包

下载地址:http://archive.apache.org/dist/hive/hive-3.1.3/apache-hive-3.1.3-bin.tar.gz

四、安装Hive

1. 上传压缩包

上传到/export/server目录下

bash 复制代码
tar -zxvf apache-hive-3.1.3-bin.tar.gz

删除压缩包

bash 复制代码
rm -rf apache-hive-3.1.3-bin.tar.gz

修改目录名

bash 复制代码
mv apache-hive-3.1.3-bin/ hive

2. 下载MySQL驱动包

下载地址:https://repo1.maven.org/maven2/mysql/mysql-connector-java/8.0.29/mysql-connector-java-8.0.29.jar

将下载好的jar包放到hive文件夹的/lib目录下

3. 配置Hive

bash 复制代码
vim /export/server/hive/conf/hive-env.sh
bash 复制代码
export HADOOP_HOME=/export/server/hadoop
export HIVE_CONF_DIR=/export/server/hive/conf
export HIVE_AUX_JARS_PATH=/export/server/hive/lib
bash 复制代码
vim /export/server/hive/conf/hive-site.xml
xml 复制代码
<configuration>
    <property>
        <name>javax.jdo.option.ConnectionURL</name>
        <value>jdbc:mysql://feilink1:3306/hive?createDatabaseIfNotExist=true&amp;useSSL=false&amp;useUnicode=true&amp;characterEncoding=UTF-8&amp;allowPublicKeyRetrieval=true</value>
    </property>

    <property>
        <name>javax.jdo.option.ConnectionDriverName</name>
        <value>com.mysql.cj.jdbc.Driver</value>
    </property>

    <property>
        <name>javax.jdo.option.ConnectionUserName</name>
        <value>root</value>
    </property>

    <property>
        <name>javax.jdo.option.ConnectionPassword</name>
        <value>123456</value>
    </property>

    <property>
        <name>hive.server2.thrift.bind.host</name>
        <value>feilink1</value>
    </property>

    <property>
        <name>hive.metastore.uris</name>
        <value>thrift://feilink1:9083</value>
    </property>

    <property>
        <name>hive.metastore.event.db.notification.api.auth</name>
        <value>false</value>
    </property>
    <property>
        <name>hive.metastore.warehouse.dir</name>
        <value>/user/hive/warehouse</value>
    </property>

</configuration>

五、初始化元数据库

在mysql中执行

bash 复制代码
CREATE DATABASE hive CHARSET UTF8;
GRANT ALL PRIVILEGES ON hive.* TO 'root'@'%';
FLUSH PRIVILEGES;

执行元数据库初始化命令

bash 复制代码
cd /export/server/hive/
bin/schematool -initSchema -dbType mysql -verbos

初始化成功

初始化成功后,会在MySQL的hive库中新建74张元数据管理的表

sql 复制代码
use hive;
show tables;

六、启动Hive

1. 权限配置

创建日志文件夹

bash 复制代码
mkdir /export/server/hive/logs

修改权限

bash 复制代码
chown -R hadoop:hadoop /export/server/hive

切换用户

bash 复制代码
su hadoop

2. 启动Hadoop

bash 复制代码
start-all.sh

3. 启动元数据服务(二选一)

前台启动

bash 复制代码
bin/hive --service metastore

后台启动

bash 复制代码
nohup bin/hive --service metastore >> logs/metastore.log 2>&1 &

4. 启动客户端(二选一)

Hive Shell方式(可以直接写SQL)

bash 复制代码
bin/hive

Hive ThriftServer方式(不能直接写SQL,需要配合外部客户端使用)

bash 复制代码
bin/hive --service hiveserver2
# 后台启动
nohup bin/hiveserver2 > /export/logs/hiveserver2.log 2>&1 &

5. 启动成功

相关推荐
Capricorn198814 分钟前
知芽研究问题看板无法推进?从孵化区到笔记的机制排查指南
大数据·论文阅读·人工智能·笔记·学习方法·论文笔记
Forever Nore19 分钟前
LeetCode 13 罗马数字转整数 - 按规则处理
linux·服务器·leetcode
我不会插花弄玉27 分钟前
2.Linux基础指令下【由浅入深-Linux】
linux·服务器
凡科网小帆33 分钟前
2026小程序商城平台哪家强,小程序商城平台选型怎么做
大数据·小程序·小程序商城平台
睿本云1 小时前
从“有数据”到“会用数据”,一次标签体系的升级能带来的改变
大数据·人工智能
牛奶咖啡131 小时前
大数据Hadoop运维应用实践——Hadoop平台常见问题与故障汇总、系统调优、网络规划与硬件存储选型
大数据·hadoop·hadoop集群操作系统调优·hadoop集群运维问题汇总·hadoop集群硬件规划·大数据平台网络规划·大数据平台硬件存储选型
雨晨源码(同名B站)1 小时前
基于Python的网易云音乐评论数据情感化分析系统 音乐爬虫信息可视化 |SnowNLP评论情感分析
开发语言·hadoop·爬虫·python·信息可视化·毕业设计
雯宝1 小时前
3. 驱动框架(块设备)
linux
MEIXIFU12 小时前
便利店实际经营面积怎么选最合适
大数据·人工智能·物联网·生活·迭代加深
观远数据2 小时前
AI+BI时代的数据合规三重门:传输、存储、消费如何一体化管控
大数据·数据分析