Hive 中 sort by 和 order by 的区别

order by会对输入做全局排序,因此只有1个reducer(多个reducer无法保证全局有序),会导致当输入规模较大时,需要较长的计算时间。

sort by不是全局排序,其在数据进入 reducer 前完成排序。

因此,如果用 sort by 进行排序,并且设置 mapred.reduce.tasks>1, 则 sort by 只保证每个 reducer 的输出有序,不保证全局有序


我们下期见,拜拜!

相关推荐
曹牧12 小时前
Java Web 开发:servlet-mapping‌
java·数据仓库·hive·hadoop
隐于花海,等待花开3 天前
18.TRUNC / LAST_DAY / NEXT_DAY 函数深度解析
大数据·hive
隐于花海,等待花开3 天前
17.DATE_FORMAT 函数深度解析
大数据·hive
隐于花海,等待花开4 天前
15.TO_DATE 函数深度解析
大数据·hive
YJlio5 天前
1 4.1 微软商店的使用(Microsoft Store:下载/安装/管理应用与游戏)
运维·hive·hadoop·windows·游戏·microsoft·计算机外设
看海的四叔5 天前
【SQL】SQL的日期与时间函数
数据库·hive·sql·数据分析·时间函数·日期函数
看海的四叔5 天前
【SQL】SQL-常见窗口函数有哪些-上篇
数据库·hive·sql·mysql·数据分析·窗口函数
It's Q5 天前
hive学习分区&&函数
hive·hadoop·学习
隐于花海,等待花开6 天前
5.TRIM / LTRIM / RTRIM 函数深度解析
大数据·hive
菜鸟小码6 天前
Hive数据模型、架构、表类型与优化策略
hive·hadoop·架构