【Hive】drop table需注意外部表

什么是内部表,外部表?

比较专业的定义:

外部表需要转为内部表,执行删除操作才能真的删表结构删表数据。否则drop table仅是删除了表数据,表结构还是存在的。

alter table tb_name set TBLPROPERTIES('EXTERNAL'='false');

这个只是把表设成内部表,如果表本身是外部表的话。如果你本来表就是内部表就不用执行这个

drop table if exists tb_name ;

Q: 内部外部是对生产账号来说的对吗?

A: 不是,内部,外部,是表的一个类型,跟生产帐号没有关系。如果是外部表,你DROP的时候只会删除表分区,但表的文件依然存在,不会做清理。

所以,如果是外部表,你在DROP的时候相当于没有做清理

注意用spark执行会报错,以下语句要使用hive执行。

ALTER TABLE tb_name SET TBLPROPERTIES('EXTERNAL' = 'FALSE');

报错信息:

INFO Error in query: Cannot set or change the preserved property key: 'EXTERNAL';

在知乎看到的解决方案:https://zhuanlan.zhihu.com/p/161771826

(其实并没有说怎么解决,可能只能hive引擎使用)

相关推荐
科技小伙20084 小时前
数据仓库ODS、DWD、DWR、DM、DIM各层介绍
数据仓库
howard200513 小时前
4.2 Hive数据表操作
hive·内部表·数据表·插入记录·查询记录
尘世壹俗人14 小时前
hadoop节点扩容和缩容操作流程
hadoop
BD_Marathon14 小时前
【Hive】复杂数据类型
数据仓库·hive·hadoop
q***318915 小时前
深入解析HDFS:定义、架构、原理、应用场景及常用命令
hadoop·hdfs·架构
isNotNullX19 小时前
怎么用数据仓库来进行数据治理?
大数据·数据库·数据仓库·数据治理
谅望者1 天前
数据分析笔记01:数据分析概述
大数据·数据库·数据仓库·数据分析
尘世壹俗人1 天前
分离Hadoop客户端单独使用
大数据·hadoop·分布式
BD_Marathon1 天前
在 Linux 环境中配置 Eclipse 以开发 Hadoop 应用
java·hadoop·eclipse