openGauss 之索引回表

一. 前言

​ 在openGauss中如果表有索引信息,查询的谓词条件中又包含索引列,openGauss支持通过索引信息快速拿到需要访问元组的位置信息,然后直接到该位置上取出元组数据,称之为回表查询。如下所示,利用索引索引列id=55快速找到t111上对应元组的位置信息,然后通过位置信息拿到id为55的元组中所有列的数据。

本文通过走读openGauss的代码了解openGauss是怎样实现回表查询的。

二. Insert处理

​ 要想实现能快速回表,那么insert时需要保存索引和物理表的位置信息关系。openGauss的insert的入口在ExecInsertT中,保存索引列与元组的位置信息代码流程如下所示:

复制代码
ExecInsertT
    pTSelf = tableam_tops_get_t_self(result_relation_desc, tuple) // pTSelf保存着的是索引对应物理表元组位置信息
        relation->rd_tam_ops->tops_get_t_self(tup);
            HeapamTopsGetTSelf
                return tup->t_self   // 元组的物理表位置信息,即元组的t_self
    ExecInsertIndexTuples
        index_insert(..values, tupleid...)  // value为索引值,tupleid为对应物理表中元组位置信息
            btinsert_internal
                _bt_doinsert
                    _bt_insertonpg
                        _bt_pgaddtup(...itup...)  // 保存索引和其物理表中元组位置信息,itup为索引对应物理表元组位置信息
三. 回表查询

​ 回表查询是在访问索引时,能通过索引的条件拿到元组的tid信息,然后到对应的物理表的tid位置上直接读取元组信息,代码入口在IndexNext,代码流程如下所示:

复制代码
IndexNext
    scan_handler_idx_getnext
        index_getnext
            tid = index_getnext_tid(scan, direction);  // 此函数将会拿到索引对应的物理表的元组地址
                DatumGetBool(FunctionCall2(procedure, PointerGetDatum(scan), Int32GetDatum(direction)));
                    btgettuple
                        _bt_gettuple_internal
                            if (!BTScanPosIsValid(so->currPos))
                                res = _bt_first(scan, dir);   // 首次扫描会将根据谓词条件二分法查找索引,并且保持满足谓词条件的起始地址和条数
                            else
                                res = _bt_next(scan, dir);  // 初始化过之后,只要没有超过条数,直接返回下一条即可
                                    currItem = &so->currPos.items[so->currPos.itemIndex];
                                        scan->xs_ctup.t_self = currItem->heapTid;    // 回表元组的地址信息   
            IndexFetchTuple(scan)   // scan中保存有需要扫描元组的位置信息tid
                tableam_scan_index_fetch_tuple
                    HeapamScanIndexFetchTuple
                        heapam_index_fetch_tuple
                            ItemPointer tid = &scan->xs_ctup.t_self     // 对应上边索引返回的元组的地址信息
                                heap_hot_search_buffer    // 拿到包含所有列完整的元组数据
相关推荐
凌虚3 小时前
面向 MySQL 用户的 PostgreSQL 快速上手指南
数据库·后端·架构
五阿哥永琪3 小时前
MySQL中操作json的函数!
数据库·mysql·json
来者皆善3 小时前
了解Mysql优化吗?如何优化索引?
数据库·mysql
赤壁小虾5 小时前
【渲染流水线】[逐片元阶段]-[透明度测试]以UnityURP为例
java·前端·数据库
MC皮蛋侠客6 小时前
SQLAlchemy 系列(七):高级建模与高效写入——批量 DML、方言与扩展
数据库·python
奈斯先生Vector7 小时前
把 Midjourney 二次编辑做成生产系统:customId 能力令牌、Action Graph 与 WebUI 精修工作台
数据库·人工智能·架构·aigc·音视频·midjourney
Lethehong7 小时前
双擎并驱·全链路并行:KFS让TB级异构增量同步秒级到达
数据库
MC皮蛋侠客7 小时前
SQLAlchemy 系列(八):AsyncIO、并发与 Web 生命周期——让每个并发任务持有自己的 Session
数据库·python
一水8 小时前
Redis实战:一个AI工作流系统里的五个应用场景,从传参到限流的完整链路
数据库·redis·wpf
枫叶v.9 小时前
Prompt Injection 防不住怎么办?从 Source-Sink 模型设计 Agent 安全边界
数据库·安全·prompt