Hive sql执行文件合并配置参数

HIVE自动合并输出的小文件的主要优化手段为:HIVE将会启动一个独立的map-reduce任务进行输出文件的merge。

set hive.merge.mapfiles = true:

在只有map的作业结束时合并小文件,

set hive.merge.mapredfiles = true:

在Map-Reduce的任务结束时合并小文件,默认为False;

set hive.merge.size.per.task = 256000000;

合并后每个文件的大小,默认256M

set hive.merge.smallfiles.avgsize=16000000;

当输出文件的平均大小小于16M时合并。

set hive.merge.orcfile.stripe.level=false;

当设置为true,orc文件进行stripe Level级别的合并,当设置为false,orc文件进行文件级别的合并。

相关推荐
不剪发的Tony老师1 小时前
VeloxDB:一款免费开源的轻量级数据库管理工具
数据库·sql
dotnet901 小时前
批量生成所有表的修改脚本
数据库·sql·oracle
灯澜忆梦3 小时前
【MySQL7】多表查询
数据库·sql
Qlittleboy4 小时前
tp5网站链接不上slqserver,计算机积极拒绝了链接
数据库·sql
snow@li1 天前
MyBatis:动态 SQL 全景梳理
数据库·sql·mybatis
z落落1 天前
T-SQL 事务(Transaction)
java·数据库·sql
ClouGence1 天前
MySQL迁移到达梦怎么做?信创数据库低停机迁移实战
数据库·sql·mysql
NineData1 天前
Oracle 长事务正在消耗 undo 空间,ChatDBA 能提前发现
数据库·sql·oracle·agent·ninedata·回滚·长事务
风曦Kisaki1 天前
MySql常用命令速查表
数据库·sql·mysql
北冥you鱼1 天前
Go语言 sql.Null 类型详解:处理数据库 NULL 值的正确姿势
数据库·sql·golang