查看Hive表信息及占用空间的方法

一、Hive下查看数据表信息的方法

方法1:查看表的字段信息

desc table_name;

方法2:查看表的字段信息及元数据存储路径

desc extended table_name;

方法3:查看表的字段信息及元数据存储路径

desc formatted table_name;

方法4:查看建表语句及其他详细信息的方法

show create table table_name;

备注:查看表元数据存储路径时,推荐方法3,信息比较清晰。

二、查看表容量大小

方法1:查看一个hive表文件总大小时(单位为Byte),可以通过一行脚本快速实现,其命令如下:

查看普通表的容量

powershell 复制代码
[pgxl@master ~]$ hadoop fs -ls /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df|awk -F ' ' '{print $5}'|awk '{a+=$1}END{print a}'
[pgxl@master ~]$ hadoop fs -ls /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df|awk -F ' ' '{print $5}'|awk '{a+=$1}END{print a/(1024*1024*1024)}'

这样可以省去自己相加,下面命令是列出该表的详细文件列表

powershell 复制代码
[pgxl@master ~]$ hadoop fs -ls /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df

统计文件详细数目

powershell 复制代码
[pgxl@master ~]$ hadoop fs -ls /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df|wc -l

查看分区表的容量

powershell 复制代码
[pgxl@master ~]$ hadoop fs -ls /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df/yyyymm=202301|awk -F ' ' '{print $5}'|awk '{a+=$1}END {print a/(1024*1024*1024)}'

这样可以省去自己相加,下面命令是列出该表的详细文件列表

powershell 复制代码
[pgxl@master ~]$ hadoop fs -ls /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df/yyyymm=202301

方法2:查看该表总容量大小,单位为G

powershell 复制代码
[pgxl@master ~]$ hadoop fs -du /home/pgxl/opt/hive-1.2.1/hive-warehouse/tmp.db/wuxn_test_df|awk ' { SUM += $1 } END { print SUM/(1024*1024*1024) }'

查看hive库的大小

powershell 复制代码
 hadoop fs -count -q -h /data/hive/warehouse/wedw_dw.db
相关推荐
weixin_307779136 小时前
Hive集群之间迁移的Linux Shell脚本
大数据·linux·hive·bash·迁移学习
王小王-12311 小时前
基于Hadoop的公共自行车数据分布式存储和计算平台的设计与实现
大数据·hive·hadoop·分布式·hadoop公共自行车·共享单车大数据分析·hadoop共享单车
王小王-12314 小时前
基于Hadoop的大规模文本词频统计分析系统设计与实现
hadoop·mapreduce·hadoop词频统计·hadoop文本统计·mapreduce词频统计
陈敬雷-充电了么-CEO兼CTO16 小时前
推荐算法系统系列>推荐数据仓库集市的ETL数据处理
大数据·数据库·数据仓库·数据挖掘·数据分析·etl·推荐算法
桂成林20 小时前
Hive UDF 开发实战:MD5 哈希函数实现
hive·hadoop·哈希算法
isNotNullX20 小时前
什么是数据分析?常见方法全解析
大数据·数据库·数据仓库·人工智能·数据分析
王小王-1231 天前
基于Hadoop的京东厨具商品数据分析及商品价格预测系统的设计与实现
hadoop·数据分析·京东厨具·厨具分析·商品分析
谷新龙0012 天前
大数据环境搭建指南:基于 Docker 构建 Hadoop、Hive、HBase 等服务
大数据·hadoop·docker
百度Geek说2 天前
搜索数据建设系列之数据架构重构
数据仓库·重构·架构·spark·dubbo
爱吃面的猫2 天前
大数据Hadoop之——Hbase下载安装部署
大数据·hadoop·hbase