Hive sql执行文件合并配置参数

HIVE自动合并输出的小文件的主要优化手段为:HIVE将会启动一个独立的map-reduce任务进行输出文件的merge。

set hive.merge.mapfiles = true:

在只有map的作业结束时合并小文件,

set hive.merge.mapredfiles = true:

在Map-Reduce的任务结束时合并小文件,默认为False;

set hive.merge.size.per.task = 256000000;

合并后每个文件的大小,默认256M

set hive.merge.smallfiles.avgsize=16000000;

当输出文件的平均大小小于16M时合并。

set hive.merge.orcfile.stripe.level=false;

当设置为true,orc文件进行stripe Level级别的合并,当设置为false,orc文件进行文件级别的合并。

相关推荐
阳光九叶草LXGZXJ6 小时前
达梦数据库-报错-11-cmd 13 validate error
linux·运维·数据库·sql·学习
long3166 小时前
PostgreSQL 学习资料 · 入门 / 练习 / 精通 / 扩展
java·数据结构·数据库·spring boot·sql·postgresql·数据库开发
阳光九叶草LXGZXJ7 小时前
达梦数据库-报错-12-[-7184]:对象定义[XXX]被修改,版本检查失败
linux·运维·服务器·数据库·sql·学习
xqqxqxxq1 天前
DQL 数据查询 select
sql
花青泽1 天前
5-数据库-SQL注入-联合查询-AND/OR绕过-day13
数据库·sql
Csvn1 天前
📊 SQL 入门 Day 11:CASE 表达式:SQL 里的 if-else 魔法
后端·sql
xqqxqxxq1 天前
SQL 字段约束笔记
android·笔记·sql
zcn1261 天前
不同列or关联同一列的等价改写
数据库·sql·sql优化改写
Francek Chen1 天前
【大数据处理与分析】实验5:MapReduce初级编程实践
大数据·hadoop·分布式·mapreduce
花青泽1 天前
5-数据库-SQL注入-联合查询-关键字绕过-day13
数据库·sql