阿里云社招一面:数据库中有 1000 万数据的时候怎么分页查询?

今天给大家分享一道阿里云社招面试中的经典问题------如何处理千万级数据的分页查询。这不仅是高频面试题,更是实际业务中必须解决的性能难题。下面我会从基础实现到阿里级优化方案,逐步拆解这个问题的技术要点。

1. 基础方案:LIMIT OFFSET的致命缺陷

面试官 :"假设订单表有1000万数据,如何实现分页查询? "

初级开发者的回答通常是:

sql 复制代码
SELECT * FROM orders ORDER BY create_time DESC LIMIT 10 OFFSET 1000000;

问题分析:

  1. 全表扫描MySQL需要先读取1000010条记录,然后丢弃前100万条
  2. 性能灾难 当OFFSET=900万时,查询可能需要10秒+
  3. 内存爆炸大偏移量会导致大量临时文件生成(Using filesort)

2. 中级优化:子查询+索引覆盖

进阶方案:

sql 复制代码
SELECT * FROM orders WHERE id <= (SELECT id FROM orders ORDER BY create_time DESC LIMIT 1000000, 1)ORDER BY create_time DESC LIMIT 10;

优化原理:

  1. 子查询先通过覆盖索引快速定位到起始ID
  2. 主查询通过主键ID范围过滤
  3. 相比OFFSET方案,性能提升10倍+

适用场景:

  • 数据量在100万-5000万级别
  • 必须有合适的索引(create_time需建立二级索引)

3. 阿里级方案:游标分页(Cursor Pagination)

面试官期待的答案:

技术要点:

  1. 无OFFSET通过上一页的最后一条记录作为游标锚点
  2. 索引友好 完美利用(create_time)索引的有序性
  3. 性能稳定无论查询第1页还是第100万页,响应时间都<100ms

业务适配:

  • 需要前端配合传递last_record_value
  • 不支持随机跳页(但符合现代APP无限滚动交互)

4. 终极方案:分库分表+二级索引

当数据量达到亿级时,阿里云实际采用的架构:

  1. 水平分片按订单ID哈希分16个库
  2. 全局索引表 单独维护(user_id, create_time)的映射关系
  • 查询流程
  • 先查索引表获取目标记录的主键ID
  • 再通过ID路由到具体分片查询完整数据
相关推荐
刚子编程12 小时前
我用 ASP.NET Core 做了个水稻病虫害检查系统
后端·asp.net
谢亮_vipxieliang12 小时前
用 PHP 构建轻量级 REST API:从路由到鉴权的完整实践
开发语言·后端·php
码事漫谈15 小时前
三步改掉 AI 味,附可直接复制的去 AI 味提示词
后端
IT_陈寒15 小时前
Redis卡顿的锅,这次真不是大key的错
前端·人工智能·后端
可乐鸡翅yeah_15 小时前
video.js 集成 hls.js 开发 M3U8 播放器,新手高频踩坑
开发语言·前端·javascript·后端·ecmascript·m3u8·音视频在线播放
程序猿_极客15 小时前
【免费】分享一套优质的基于SpringBoot的服装商城管理系统的设计与实现(带可视化图表、协同过滤功能),源码+文档+视频详解(讲解)
java·spring boot·后端·服装商城管理系统
明月_清风16 小时前
面对陌生的 GitHub 项目无从下手?这 4 个网站帮你快速读懂源码
前端·后端·github
bug菌16 小时前
🤔同事突然问我:Spring的注解 @Component 和 @Service 有何不同?
java·spring boot·后端
leobertlan16 小时前
痛苦系列 | DSP-02 频域切片:DTFT与DFT的探索
android·后端