Hive之数据操作DML

Hive之数据操作DML


### 文章目录

  • Hive之数据操作DML
  • @[toc]
  • 写在前面
  • 数据导入
  • 向表中装载数据(Load)
  • 通过查询语句向表中插入数据(Insert)
  • 查询语句中创建表并加载数据(As Select)
  • 创建表时通过Location指定加载数据路径
  • Import数据到指定Hive表中
  • 5.2 数据导出
  • Insert导出
  • Hadoop命令导出到本地
  • Hive Shell 命令导出
  • Export导出到HDFS上
  • 清除表中数据(Truncate)

写在前面

  • Linux版本:CentOS7.5
  • Hive版本:Hive-3.1.2

数据导入

向表中装载数据(Load)

(1)语法

sql 复制代码
hive> load data [local] inpath '数据的path' [overwrite] into table student [partition (partcol1=val1,...)];
  • load data:表示加载数据

  • local:表示从本地加载数据到hive表;否则从HDFS加载数据到hive表

  • inpath:表示加载数据的路径

  • overwrite:表示覆盖表中已有数据,否则表示追加

  • into table:表示加载到哪张表

  • student:表示具体的表

  • partition:表示上传到指定分区

(2)实操案例

  • 创建一张表
sql 复制代码
hive (default)> create table student(id string, name string) row format delimited fields terminated by '\t';
  • 加载本地文件到hive
sql 复制代码
hive (default)> load data local inpath '/expoer/servre/hive-3.1.2/datas/student.txt' into table default.student;
  • 加载HDFS文件到hive中

上传文件到HDFS

sql 复制代码
hive (default)> dfs -put /expoer/servre/hive-3.1.2/datas/student.txt /user/whybigdata/hive;

加载HDFS上数据

sql 复制代码
hive (default)> load data inpath '/user/whybigdata/hive/student.txt' into table default.student;

(3)加载数据覆盖表中已有的数据

上传文件到HDFS

sql 复制代码
hive (default)> dfs -put /export/server/datas/student.txt /user/whybigdata/hive;

加载数据覆盖表中已有的数据

sql 复制代码
hive (default)> load data inpath '/user/whybigdata/hive/student.txt' overwrite into table default.student;

通过查询语句向表中插入数据(Insert)

(1)创建一张表

sql 复制代码
hive (default)> create table student_par(id int, name string) row format delimited fields terminated by '\t';

(2)基本插入数据

sql 复制代码
hive (default)> insert into table  student_par values(1,'wangwu'),(2,'zhaoliu');

(3)基本模式插入(根据单张表查询结果)

sql 复制代码
hive (default)> insert overwrite table student_par 
             select id, name from student ; 
  • insert into:以追加数据的方式插入到表或分区,原有数据不会删除

  • insert overwrite:会覆盖表中已存在的数据

注意:insert不支持插入部分字段

(4)多表(多分区)插入模式(根据多张表查询结果)

sql 复制代码
hive (default)> from student
              insert overwrite table student partition(month='201707')
              select id, name where month='201709'
              insert overwrite table student partition(month='201706')
              select id, name where month='201709';

查询语句中创建表并加载数据(As Select)

根据查询结果创建表(查询的结果会添加到新创建的表中)

sql 复制代码
create table if not exists student3
as select id, name from student;

创建表时通过Location指定加载数据路径

(1)上传数据到hdfs上

sql 复制代码
hive (default)> dfs -mkdir /student;
hive (default)> dfs -put /export/server/datas/student.txt /student;

(2)创建表,并指定在hdfs上的位置

sql 复制代码
hive (default)> create external table if not exists student5(
              id int, name string
              )
              row format delimited fields terminated by '\t'
              location '/student;

(3)查询数据

sql 复制代码
hive (default)> select * from student5;

Import数据到指定Hive表中

注意:先用export导出后,再将数据导入。

sql 复制代码
hive (default)> import table student2  from
 '/user/hive/warehouse/export/student';

5.2 数据导出

Insert导出

(1)将查询的结果导出到本地

sql 复制代码
hive (default)> insert overwrite local directory '/expoer/servre/hive-3.1.2/datas/export/student'
            select * from student;

(2)将查询的结果格式化导出到本地

sql 复制代码
hive(default)>insert overwrite local directory '/expoer/servre/hive-3.1.2/datas/export/student1'
           ROW FORMAT DELIMITED FIELDS TERMINATED BY '\t'             select * from student;

(3)将查询的结果导出到HDFS上(没有local)

sql 复制代码
hive (default)> insert overwrite directory '/user/whybigdata/student2'
             ROW FORMAT DELIMITED FIELDS TERMINATED BY '\t' 
             select * from student;

Hadoop命令导出到本地

sql 复制代码
hive (default)> dfs -get /user/hive/warehouse/student/student.txt
/export/server/datas/export/student3.txt;

Hive Shell 命令导出

基本语法:(hive -f/-e 执行语句或者脚本 > file)

shell 复制代码
[whybigdata@wbd01 hive]$ bin/hive -e 'select * from default.student;' >
 /expoer/servre/hive-3.1.2/datas/export/student4.txt;

Export导出到HDFS上

sql 复制代码
(defahiveult)> export table default.student to
 '/user/hive/warehouse/export/student';

export和import主要用于两个Hadoop平台集群之间Hive表迁移。

清除表中数据(Truncate)

注意:Truncate只能删除管理表,不能删除外部表中数据

sql 复制代码
hive (default)> truncate table student;

全文结束!!!

相关推荐
Future_yzx1 小时前
深入理解SpringMVC:数据处理、文件上传与异常处理等常见技术应用及解决方案
大数据·hive·hadoop
jonyleek2 小时前
「JVS更新日志」生产计划排程系统APS已上线!以及智能BI、低代码、规则引擎2.6更新说明
java·大数据·低代码·数据分析·软件需求
大厂在职_Xbg2 小时前
Git Command(待更新)
大数据·git·elasticsearch
抛砖者3 小时前
04. Flink的状态管理与容错机制
大数据·flink
Data-Miner3 小时前
精品PPT | 企业大数据治理平台统一指标库建设方案
大数据
SeaTunnel3 小时前
Apache SeaTunnel 整体架构运行原理
大数据
云上的阿七4 小时前
Elasticsearch集群模式保姆级教程
大数据·elasticsearch
数据智能老司机5 小时前
使用 Databricks Lakehouse 构建现代数据应用程序——使用 Delta Live Tables 应用数据转换
大数据·架构·数据分析
数据智能老司机5 小时前
使用 Databricks Lakehouse 构建现代数据应用程序——使用 Delta Live Tables 管理数据质量
大数据·架构·数据分析