一句话总结所有关键点:
-
`skipTo(target)` 的返回值 不是"跳过的精确文档数",而是上一个间隔已跳过累计数;
-
`lastDoc` 是 小于 target 的最后一个间隔的最后一个 docID;
-
`lastChildPointer` 指向 ≥ target 的那个间隔在 posting 列表中的起始文件指针;
-
Lucene 把 docID 按全局升序排序后,只有第一个存绝对 docID,其余全部存"与前一个的差值";
-
这些差值被 128 个一组 block 压缩,但差值链 跨 block 连续,不会因为换块而重置;
-
读 block 时给 `base`(上一 block 最后一个绝对 docID),就地累加本 block 128 个 delta,避免从文件头一路算到当前位置,实现 O(1) 定位 + O(128) 解压。
