Hive分桶表

分桶表

一、准备数据

markdown 复制代码
1,wsq1
2,wsq2
3,wsq3
4,wsq4
5,wsq5

二、开启分桶表的支持

sql 复制代码
set hive.enforce.bucketing=true;
set mapreduce.job.reduces=4;
set mapreduce.reduce.task=4;

三、创建分桶表

sql 复制代码
hive>create table bucketed_users(id int,name string) clustered by (id) sorted by (id) into 4 buckets row format delimited fields terminated by ',';

四、创建存放数据的表并将原数据加载入

sql 复制代码
hive> create table users(id int,name string) row format delimited fields terminated by ',';
hive> load data local inpath '/home/ec2-user/total/wsq' into table users;

五、数据装载到分桶表

sql 复制代码
hive> insert into bucketed_users select * from users;
相关推荐
还是大剑师兰特7 小时前
Hadoop入门基础教程(110 问题+ 答案)
hadoop·大剑师·hadoop教程·hadoop入门
笨蛋少年派7 小时前
Sqoop数据迁移简介
hive·hadoop·sqoop
zhangkaixuan4567 小时前
Flink Checkpoint 全生命周期深度解析
大数据·hadoop·flink·apache·paimon
我的offer在哪里8 小时前
Hadoop 全维度技术深度解析
hadoop
沧海寄馀生8 小时前
Apache Hadoop生态组件部署分享-Impala
大数据·hadoop·分布式·apache
云闲不收8 小时前
clickhouse hbase Hive 区别
hive·clickhouse·hbase
IIIIIILLLLLLLLLLLLL19 小时前
Hadoop集群时间同步方法
大数据·hadoop·分布式
RestCloud1 天前
神州通用数据库的 ETL 集成方案:兼容性与性能实战
数据库·数据仓库·etl·数据处理·数据集成·数据传输·神州通用
Macbethad1 天前
WPF工业设备诊断管理程序技术方案
大数据·hadoop·分布式
稚辉君.MCA_P8_Java1 天前
Gemini永久会员 Hadoop分布式计算框架MapReduce
大数据·hadoop·分布式·架构·mapreduce