ES分页问题

分页方式3种

  1. from + size 浅分页
    其中,from定义了目标数据的偏移值,size定义当前返回的数目。默认from为0,size为10,即所有的查询默认仅仅返回前10条数据。越往后查询效率越低; 5w条以内勉强可用;
    如果搜索size大于10000,需要设置index.max_result_window参数

    PUT _settings
    {
    "index": {
    "max_result_window": "10000000"
    }
    }

  2. scroll 深分页,
    滚动读取, 相当于创建一个索引快照,然后按照索引依次去查询;

    GET test_dev/_search?scroll=5m
    {
    "query": {
    "bool": {
    "filter": [
    {
    "term": {
    "age": 28
    }
    }
    ]
    }
    },
    "size": 10,
    "from": 0,
    "sort": [
    {
    "timestamp": {
    "order": "desc"
    },
    "_id": {
    "order": "desc"
    }
    }
    ]
    }

scroll=5m表示设置scroll_id保留5分钟可用。

使用scroll必须要将from设置为0。

size决定后面每次调用_search搜索返回的数量;

然后我们可以通过数据返回的_scroll_id读取下一页内容,每次请求将会读取下10条数据,直到数据读取完毕或者scroll_id保留时间截止;

缺点:

① 不能跳页读取,只能顺序读取;

②历史快照,不能查询实时数据;

③scroll_id会占用大量的资源,尤其是排序(用完后要记得删除)

2.2 Scroll Scan 的遍历与普通 Scroll 一样,初始化存在一点差别,但没有排序功能;

Scroll-Scan结果没按index顺序返回,没有排序,可以提高取数据性能。

2.3 Sliced Scroll 切片并发, 与Scroll Scan类似只是进行切片,然后并发执行;

  1. Search After (ES5之后才有的)
    search_after 分页的方式是根据上一页的最后一条数据来确定下一页的位置,同时在分页请求的过程中,如果有索引数据的增删改查,这些变更也会实时的反映到游标上。但是需要注意,因为每一页的数据依赖于上一页最后一条数据,所以无法跳页请求。 这就要求每个文档必须有一个全局唯一值

参考: https://juejin.cn/post/7092046739414204430

相关推荐
服务端相声演员13 小时前
MySQL的select distinct ..Union all和select..union的区别
数据库·mysql
2501_9304724413 小时前
深度复盘|数据库迁移实战(下):从自建 MySQL 5.7 到腾讯云 MySQL 8.0 的 SQL 兼容改造
数据库·mysql·腾讯云
2501_9304724413 小时前
深度复盘|数据库迁移实战(上):腾讯云助手解析慢查询日志,定位索引缺失与语法不兼容
数据库·阿里云·ffmpeg·云计算·腾讯云·aws
SelectDB技术团队13 小时前
从 ClickHouse 迁移到 Doris:SQL 兼容、同步与验证清单
数据库·人工智能·sql·clickhouse·apache doris·selectdb·湖仓架构升级
敲代码的嘎仔14 小时前
从零实现视频续播 + 学习进度统计:前端心跳、条件更新、GROUP BY 统计全链路拆解
java·前端·数据库·学习·面试·职场和发展·音视频
草莓熊Lotso14 小时前
【Redis 初阶】C++ 客户端实战:从 RESP 协议到 redis-plus-plus 工程化用法
linux·开发语言·网络·数据库·c++·redis·缓存
dunge202614 小时前
2026年9月11日|ChatGPT Pro + Codex:GPT‑6 Astra 数据库性能优化
数据库·gpt·chatgpt
NeilYuen14 小时前
【kv存储】结合faiss构建向量内存数据库
数据库·faiss
风哥2号14 小时前
数据库教程FGMT18‑Oracle‑EMCC智能化集中运维管理系统
运维·数据库·oracle
YHHLAI14 小时前
基于 Next.js 16 + Redis 的全栈笔记博客系统
javascript·redis·笔记