Hive 中 sort by 和 order by 的区别

order by会对输入做全局排序,因此只有1个reducer(多个reducer无法保证全局有序),会导致当输入规模较大时,需要较长的计算时间。

sort by不是全局排序,其在数据进入 reducer 前完成排序。

因此,如果用 sort by 进行排序,并且设置 mapred.reduce.tasks>1, 则 sort by 只保证每个 reducer 的输出有序,不保证全局有序


我们下期见,拜拜!

相关推荐
步行cgn7 小时前
在 HTML 表单中,name 和 value 属性在 GET 和 POST 请求中的对应关系如下:
前端·hive·html
喂完待续15 小时前
【Tech Arch】Hive技术解析:大数据仓库的SQL桥梁
大数据·数据仓库·hive·hadoop·sql·apache
beijingliushao3 天前
33-Hive SQL DML语法之查询数据-2
hive·hadoop·sql
让头发掉下来4 天前
Hive 创建事务表的方法
大数据·hive·hadoop
W.A委员会4 天前
SpringMVC
数据仓库·hive·hadoop·spring
王小王-1234 天前
基于Hadoop的全国农产品批发价格数据分析与可视化与价格预测研究
大数据·hive·hadoop·flume·hadoop农产品价格分析·农产品批发价格·农产品价格预测
beijingliushao7 天前
30-Hive SQL-DML-Load加载数据
数据仓库·hive·apache
シ風箏7 天前
Hive【应用 04】常用DDL操作(数据库操作+创建表+修改表+清空删除表+其他命令)
数据库·hive·hadoop
hrrrrb8 天前
【Spring Boot 快速入门】八、登录认证(二)统一拦截
hive·spring boot·后端
伴生伴熟9 天前
hive-日期拆分为多行
hive·拆分·日期