删除和清空Hive外部表数据

外部表和内部表区别

未被external修饰的是内部表(managed table),被external修饰的为外部表(external table);

区别:

内部表数据由Hive自身管理,外部表数据由HDFS管理;

内部表数据存储的位置是hive.metastore.warehouse.dir(默认:/user/hive/warehouse),外部表数据的存储位置由自己制定(如果没有LOCATION,Hive将在HDFS上的/user/hive/warehouse文件夹下以外部表的表名创建一个文件夹,并将属于这个表的数据存放在这里);

删除内部表会直接删除元数据(metadata)及存储数据;删除外部表仅仅会删除元数据,HDFS上的文件并不会被删除;

对内部表的修改会将修改直接同步给元数据,而对外部表的表结构和分区进行修改,则需要修复(MSCK REPAIR TABLE table_name;)

查看当前Hive版本

复制代码
hive --version

Hive 3.1.3

查看外部表存储位置

复制代码
SHOW CRAETE TABLE table_name

找到完整建表语句中LOCATION对应的字符串及为该外部表存储的位置。

删除外部表

方式一:Hadoop命令
  1. 直接删除hdfs表对应的目录

    复制代码
    hadoop fs -rm -r /user/hive/warehouse/database_name.db/table_name
  2. 删除元数据

    复制代码
    drop table table_name
方式二:Hive配置
  1. 配置一:内外部表转换配置
  • 外部表转为内部表

    复制代码
    ALTER TABLE table_name SET TBLPROPERTIES('EXTERNAL'='False')

    注意:上面的写法是hive0.6就已经有了,从hive2.4之后,字符串'False'可以直接写出布尔类型的False了。

  • 执行drop命令

    复制代码
    DROP TABLE table_name
  1. 配置二:删除外部表数据配置
  • 打开删除外部表数据配置

    复制代码
    ALTER TABLE table_name  SET TBLPROPERTIES ('external.table.purge'='true')

    注意:该配置 是hive4.0.0开始才有的,但是向下兼容。

  • 执行drop命令

    复制代码
    DROP TABLE table_name

清空外部表

清空外部表一般就用修改hive配置的方式,具体和删除的操作类似,只是把DROP换成TRUNCATE,这里就不在赘述了。

参考文献

LanguageManual DDL

相关推荐
Gain_chance9 小时前
34-学习笔记尚硅谷数仓搭建-DWS层最近一日汇总表建表语句汇总
数据仓库·hive·笔记·学习·datagrip
Gain_chance11 小时前
35-学习笔记尚硅谷数仓搭建-DWS层最近n日汇总表及历史至今汇总表建表语句
数据库·数据仓库·hive·笔记·学习
无级程序员20 小时前
大数据Hive之拉链表增量取数合并设计(主表加历史表合并成拉链表)
大数据·hive·hadoop
华农DrLai1 天前
Spark SQL Catalyst 优化器详解
大数据·hive·sql·flink·spark
十月南城2 天前
Hive与离线数仓方法论——分层建模、分区与桶的取舍与查询代价
数据仓库·hive·hadoop
鹏说大数据2 天前
Spark 和 Hive 的关系与区别
大数据·hive·spark
B站计算机毕业设计超人2 天前
计算机毕业设计Hadoop+Spark+Hive招聘推荐系统 招聘大数据分析 大数据毕业设计(源码+文档+PPT+ 讲解)
大数据·hive·hadoop·python·spark·毕业设计·课程设计
B站计算机毕业设计超人2 天前
计算机毕业设计hadoop+spark+hive交通拥堵预测 交通流量预测 智慧城市交通大数据 交通客流量分析(源码+LW文档+PPT+讲解视频)
大数据·hive·hadoop·python·spark·毕业设计·课程设计
AI架构师小马2 天前
Hive调优手册:从入门到精通的完整指南
数据仓库·hive·hadoop·ai
数据架构师的AI之路2 天前
深入了解大数据领域Hive的HQL语言特性
大数据·hive·hadoop·ai