SQL_SQL_常见面试问题

问题类型 :SQL优化

问题描述 :用户浏览日志(date, user_id, video_id), 统计 2020.03.29 观看不同视频个数的前5名 user_id。

思路 :主要注意预计算,避免直接去重

解决方案 :

Hive_HQL_Hive优化_复杂SQL_观看不同视频个数的前5名_sql观看视频数最多的前五名用户_高达一号的博客-CSDN博客

问题类型 :窗口函数使用

问题 求连续n月的下单用户

有如下表 ,求连续3个月的下单用户

order_no | uid | dep_no | amount | datetime

1 | 2002 | 20 | 2000.0 | 2023-04-25 12:30:20

解题方案 : Hive_HQL_复杂SQL_连续发单天数_hive支持复杂sql_高达一号的博客-CSDN博客

问题 求年度分月份,累计下单金额

有如下表 ,求业务部分月的年累计订单金额

order_no | uid | dep_no | amount | datetime

1 | 2002 | 20 | 2000.0 | 2023-04-25 12:30:20

问题 求路径访问深度

今天面试遇到了一道题,通过HQL 求访问深度以及当前页与下一页面的地址

前提假设:

1.用户只访问同一page一次

2.用户单一标签页跳转

有如下图1 转换为 图2 格式,即访问路径问题

问题答案 : HIVE_SQL_复杂SQL_求访问深度以及前一跳和下一跳的地址_高达一号的博客-CSDN博客

问题类型 :SQL巧解答

问题 已知登陆表中有 uid、login_time,求每个用户的最大连续登陆天数

uid、login_time

A | 2020-08-01 10:00:00

(该问题为窗口函数问题中 : 连续n月下单用户的延申题目,可以两道问题一起考察)

问题答案 : SQL 求最大连续登陆天数_连续登录天数sql_机灵小布衣的博客-CSDN博客

相关推荐
SeaTunnel14 小时前
Apache SeaTunnel MCP Server:让AI成为你的ETL助手
人工智能·apache·etl
zhangjin12222 天前
kettle插件-postgresql插件
大数据·postgresql·etl·kettle cdc·kettle插件·kettle实时数据同步
ETLCloud数据集成社区4 天前
ETLCloud是如何通过Oracle实现CDC的?
数据库·oracle·etl·实时数据同步
zhangjin12225 天前
kettle从入门到精通 第九十四课 ETL之kettle MySQL Bulk Loader大批量高性能数据写入
大数据·数据仓库·mysql·etl·kettle实战·kettlel批量插入·kettle mysql
RestCloud9 天前
ETL中数据转换的三种处理方式
数据仓库·etl·数字化转型·数据转换·api管理
RestCloud10 天前
ETL中三种数据加载性能优化的方式
数据仓库·性能优化·etl·数字化转型·数据集成平台·数据加载方式
RestCloud10 天前
ETL 自动化:提升数据处理效率与准确性的核心驱动力
数据仓库·自动化·api·etl·数字化转型·数据集成平台
RestCloud13 天前
ETL:数据清洗、规范化和聚合的重要性
数据仓库·etl·数据清洗·api接口·数据集成·集成工具
weixin_3077791314 天前
稳定运行的以Oracle NoSQL数据库为数据源和目标的ETL性能变差时提高性能方法和步骤
数据库·oracle·性能优化·etl
weixin_3077791315 天前
稳定运行的以Neo4j图数据库为数据源和目标的ETL性能变差时提高性能方法和步骤
数据库·性能优化·neo4j·etl