Hive sql执行文件合并配置参数

HIVE自动合并输出的小文件的主要优化手段为:HIVE将会启动一个独立的map-reduce任务进行输出文件的merge。

set hive.merge.mapfiles = true:

在只有map的作业结束时合并小文件,

set hive.merge.mapredfiles = true:

在Map-Reduce的任务结束时合并小文件,默认为False;

set hive.merge.size.per.task = 256000000;

合并后每个文件的大小,默认256M

set hive.merge.smallfiles.avgsize=16000000;

当输出文件的平均大小小于16M时合并。

set hive.merge.orcfile.stripe.level=false;

当设置为true,orc文件进行stripe Level级别的合并,当设置为false,orc文件进行文件级别的合并。

相关推荐
让头发掉下来5 小时前
Flink SQL 中两个频繁变化 Topic 的 Join 行为分析
大数据·数据库·sql·flink
vHelios5 小时前
【电商项目】测试 授权功能 遇到的问题与解决方案
java·spring boot·sql
johnny2336 小时前
用SQL查MQ:Trino、PGMQ、KsqlDB、Proton、OpenLooKeng、KarelDB
sql
l1t6 小时前
用李红艳先生的DuckDB luajit插件批量计算数独
数据库·sql·lua·duckdb
光电的一只菜鸡19 小时前
小白从零开始学agent(二)——如何高效编写 Prompt 与 Skill
hadoop·microsoft·prompt
影寂ldy20 小时前
SQL 事务(Transaction)完整版学习笔记(含转账案例+存储过程+异常捕获)
笔记·sql·学习
灯澜忆梦1 天前
【MySQL10】进阶篇 | 索引_#1
数据库·sql·mysql
wear工程师1 天前
MySQL 分页为什么会重复数据:补上 id 还不够
sql·mysql
ClouGence1 天前
告别 Navicat!CloudDM:开源免费一站式数据库开发管理工具
数据库·sql·开源·数据库开发
xqqxqxxq2 天前
SQL 连接查询技术笔记
数据库·笔记·sql