Hive序列函数&&排名函数

序列函数

ntile

sql 复制代码
# 获取一个表中,所有消费记录,每个人后50%的消费记录
with t as (
	select *,ntile(2) over(partition by name) xh from t_order
)
select * from t where xh = 2

lag & lead

sql 复制代码
# 获取上一次的消费记录

	select *,lag(orderdate,1,1900-01-01) over(partition by name order by orderdate) from t_order
sql 复制代码
# 5分钟,点击100次的用户

	select id,dt,lag(dt,100),

排名函数

1、row_numer() 没有并列

2、rank() 存在并列,存在空位

3、dense_rank() 存在并列,不存在空位

相关推荐
RestCloud12 小时前
Informatica迁移国产ETL完整实施指南:ETLCloud自动化平滑替换方案
数据仓库·etl·etlcloud·数据传输·数据集成工具·informatica·国产化替代
Database_Cool_2 天前
云数据仓库开通指南:阿里云 AnalyticDB MySQL 10 分钟从 0 到分析实战教程
数据仓库·mysql·阿里云
曾阿伦3 天前
Windows 下运行 Hadoop 并部署到 AWS EMR 指南
hadoop·windows·aws
罗政3 天前
基于AI工作流的多渠道销售数据仓库清洗统计实践
数据仓库
极光代码工作室4 天前
基于Spark的日志监控与分析平台
大数据·hadoop·python·spark·数据可视化
迈巴赫车主5 天前
湖仓一体(Data Lakehouse)简介
大数据·数据仓库·数据湖·湖仓一体
liuxiaowei35 天前
Winform+WPF双框架实战:喷涂工艺SCADA上位机从0到1搭建(附采集监控源码+车间踩坑实录)
大数据·hadoop·wpf
humbinal6 天前
同时支持 gui & cli 的 parquet 文件查看工具,高性能小清新!
hive·python·rust·spark·开源·github·parquet
RestCloud7 天前
ETL是什么?全域数据集成平台核心能力解析
数据仓库·etl·数据清洗·数据处理·etlcloud·数据集成工具