【Elasticsearch】副本恢复机制文件级(file-based)操作级(ops-based)顶级理解

两种恢复最终都要**让副本的 Lucene 段文件跟主分片一致**,但"动手对象"不同:

  1. **文件级(file-based)**
  • 直接复制**整个段文件(.cfs、.si、.dvd ...)**到副本节点

  • 副本**原样替换**自己的目录,**不再逐条解析**

  • 过程中**不打开 Lucene 文档**,只搬运字节;最后由副本自己打开 IndexWriter 做一次 commit 即可

  1. **操作级(ops-based)**
  • 不复制段文件,而是**一条条发 Translog.Operation**

  • 副本收到后,**在本地的 IndexWriter 上重放**:addDocument、deleteDocument、updateDocument ...

  • 每条操作都会**实时写副本的 Lucene 段**,也会写副本的 translog,最后 commit

→ 所以:

  • **文件级**:**主分片**的 Lucene 文件 → **副本磁盘**(字节搬运)

  • **操作级**:**主分片**的 Lucene 文档 → **反序列化成操作** → **副本 IndexWriter** → **副本的 Lucene 文件**(逐条写入)

**最终都是让副本的 Lucene 段保持一致,只是路径不同:一个"整块复制",一个"逐条重放"。**

操作级(ops-based)恢复跟**物理 translog 文件**完全无关:

  1. 主分片**不读自己的 `.tlog` 文件**;

  2. 用 `LuceneChangesSnapshot` **直接从 Lucene 倒排表里**按 `_seq_no` 把文档/墓碑捞出来;

  3. 现场包成 `Translog.Index` / `Delete` / `NoOp` 对象发给副本;

  4. 副本收到后,**在自己的 IndexWriter 上重放**这些操作,生成**自己的** Lucene 段。

因此整个流程**既不读主分片的 translog 文件,也不依赖 translog 文件做传输**,只是借用了"Translog.Operation"这个统一的数据结构而已。

相关推荐
字节跳动数据库2 分钟前
火山引擎 RDS MySQL 向量索引:把高性能向量检索带到 MySQL 上
人工智能·后端·mysql
小白的后端世界4 分钟前
LangChain 模型初始化参数详解:从基础配置到企业级实践
java·人工智能·langchain
广州浮点FLOATLIC12 分钟前
Mentor Graphics浮动许可证管理为什么一到流片节点就失控
java·大数据·数据库·许可证管理·cad 许可证优化
Loongproxy27 分钟前
大规模采集为啥用隧道代理IP?会话保持如何做到无感轮换
java·服务器·网络
小王C语言40 分钟前
MySQL 库的操作:字符集和校验规则、数据库的增删查改、备份和还原
数据库·mysql
杰克尼1 小时前
天机学堂面试题
java
Web极客码1 小时前
用 Python 搭建工具调用 Agent 的调试过程
java·服务器·前端
小王C语言1 小时前
MySQL 数据类型:数值类型、字符串类型、日期和时间类型、enum 和 set、find_in_set 查询
android·数据库·mysql
童槿顏丶1 小时前
Jenkins部署(Docker)
java·docker·jenkins
我命由我123451 小时前
Android 控件 - CardView(快速实现圆角)
android·java·java-ee·kotlin·android studio·android-studio·android runtime