Hive 中 sort by 和 order by 的区别

order by会对输入做全局排序,因此只有1个reducer(多个reducer无法保证全局有序),会导致当输入规模较大时,需要较长的计算时间。

sort by不是全局排序,其在数据进入 reducer 前完成排序。

因此,如果用 sort by 进行排序,并且设置 mapred.reduce.tasks>1, 则 sort by 只保证每个 reducer 的输出有序,不保证全局有序


我们下期见,拜拜!

相关推荐
梦痕长情10 小时前
记一次hiveSQL 查询无数据,String类型的字段自动转化为int类型的经历和解决方案
hive
weixin_4624462312 小时前
Hadoop / YARN / Hive 运维操作教程
运维·hive·hadoop
無森~1 天前
Hive概述
数据仓库·hive·hadoop
無森~1 天前
Hive下载与安装
数据仓库·hive·hadoop
大鳥1 天前
Hive on Spark SQL 性能优化权威指南
hive·sql·spark
無森~1 天前
Hive输出表信息中文乱码解决方案
数据仓库·hive·hadoop
B站计算机毕业设计超人2 天前
计算机毕业设计Python+百度千问大模型微博舆情分析预测 微博情感分析可视化 大数据毕业设计(源码+LW文档+PPT+讲解)
大数据·hive·hadoop·python·毕业设计·知识图谱·课程设计
王九思3 天前
大数据查询工具Hive介绍
大数据·hive·hadoop
王九思3 天前
Hive Hook 机制
数据仓库·hive·hadoop
lipWOFb3 天前
扩展卡尔曼滤波soc估算 基于EKF算法的锂电池SOC 卡尔曼滤波估计电池soc ,simul...
hive