Hive sql执行文件合并配置参数

HIVE自动合并输出的小文件的主要优化手段为:HIVE将会启动一个独立的map-reduce任务进行输出文件的merge。

set hive.merge.mapfiles = true:

在只有map的作业结束时合并小文件,

set hive.merge.mapredfiles = true:

在Map-Reduce的任务结束时合并小文件,默认为False;

set hive.merge.size.per.task = 256000000;

合并后每个文件的大小,默认256M

set hive.merge.smallfiles.avgsize=16000000;

当输出文件的平均大小小于16M时合并。

set hive.merge.orcfile.stripe.level=false;

当设置为true,orc文件进行stripe Level级别的合并,当设置为false,orc文件进行文件级别的合并。

相关推荐
动力 continue6 小时前
MySQL 基础篇 · SELECT 查询大
数据库·sql·mysql·select
先吃饱再说9 小时前
后端开发绕不开的 SQL:从建表、查询到索引优化,一篇讲透
数据库·后端·sql
fastjson_10 小时前
Hive 复杂数据类型
数据仓库·hive·hadoop
陈年老古董11 小时前
Shell 脚本编程基础完整学习笔记
linux·sql·mysql
爱吃面的猫12 小时前
大数据Hadoop之——集群环境搭建(了解)
大数据·hadoop·flume
冰暮流星13 小时前
MySQL 流程函数详解
数据库·sql·mysql
起名真的太难了14 小时前
Mysql的数据类型,查询与备份操作
数据库·sql·mysql
一路向北finish15 小时前
《Hadoop 高可用集群与 OpenStack Mitaka 控制节点部署全流程实操排坑指南》
大数据·linux·运维·服务器·hadoop·openstack
insertYam15 小时前
[hadoop高可用架构]
大数据·hadoop·架构