Hive 中 sort by 和 order by 的区别

order by会对输入做全局排序,因此只有1个reducer(多个reducer无法保证全局有序),会导致当输入规模较大时,需要较长的计算时间。

sort by不是全局排序,其在数据进入 reducer 前完成排序。

因此,如果用 sort by 进行排序,并且设置 mapred.reduce.tasks>1, 则 sort by 只保证每个 reducer 的输出有序,不保证全局有序


我们下期见,拜拜!

相关推荐
AI_56782 天前
Hive SQL优化:分区表+分桶表提升查询效率
人工智能·hive·ai
旺仔Sec4 天前
手把手教你从零搭建 Hive 2.3.6 + MySQL 元数据存储(含视频教程)
hive·hadoop·mysql
人道领域5 天前
SSM框架从入门到入土(SpringMVC入门开发全流程解析)
数据仓库·hive·hadoop
Mr泓5 天前
数据仓库建设-(数仓分层篇)
大数据·数据仓库·hive
火龙谷5 天前
【hadoop】Hive数据仓库安装部署
数据仓库·hive·hadoop
lhxsir6 天前
HIVE表结构和注释
数据仓库·hive·hadoop
熹乐互动6 天前
亲测有效的酒吧互动点歌系统案例分享
hive
我要用代码向我喜欢的女孩表白7 天前
hive高阶,了解hive相关问题,面试
数据仓库·hive·hadoop
longxibo7 天前
【Ubuntu datasophon1.2.1 二开之五:解决HIVE安装问题】
linux·hive·ubuntu
Gain_chance7 天前
34-学习笔记尚硅谷数仓搭建-DWS层最近一日汇总表建表语句汇总
数据仓库·hive·笔记·学习·datagrip