PgSQL-执行器机制-Unique算子

PgSQL-执行器机制-Unique算子

PgSQL中输出去重的元组有多种方法,比如通过HashAgg或者GroupAgg。这里我们介绍第三种方法,通过Unique算子来完成这个功能。当然语句上可以是:select distinct(id1) from t;

1、ExecUnique

执行器执行算子的函数都是ExecXXX,其中XXX代表某个算子。Unique算子的执行是由函数ExecUnqiue完成,当然这个函数执行的前提是Unique节点的子节点传来的元组是有序的,比如子节点是Sort算子。

执行逻辑比较简单:

php 复制代码
ExecUnique
  outerPlan = outerPlanState(node);//子计划节点
  resultTupleSlot = node->ps.ps_ResultTupleSlot;//返回的元组存在此处
  for (;;){//for循环找到最后一个重复的值
    slot = ExecProcNode(outerPlan);//从子节点拉取数据
    if (TupIsNull(slot)){//子节点拉取完
      return NULL;//执行结束
    }
    //总是返回第一个元组,第一个元组时resultTupleSlot为空
    if (TupIsNull(resultTupleSlot))
      break;
    //后面相同的记录进行Qual比较
    econtext->ecxt_innertuple = slot;
    econtext->ecxt_outertuple = resultTupleSlot;
    if (!ExecQualAndReset(node->eqfunction, econtext))
      break;//直到元组不同时结束循环
  }
  //将获取的元组拷贝到resultTupleSlot中并返回
  return ExecCopySlot(resultTupleSlot, slot);

1)获取第一个元组时,node->ps.ps_ResultTupleSlot中没有数值,即为NULL

2)从子节点拉取一个元组值,此时直接中断循环,将该元组值赋值给node->ps.ps_ResultTupleSlot并返回

3)再次迭代进入ExecUnique函数,node->ps.ps_ResultTupleSlot仍旧是上次保存的元组值,不为空。For循环从子节点再拉取一个元组值,需要和上次保存的值进行比较,若相同则继续循环拉取下个值进行比较,直到和node->ps.ps_ResultTupleSlot值不相等

4)退出循环后,将下一组的第一个值保存到node->ps.ps_ResultTupleSlot返回。

这样就完成了数值的去重,这里重申下,使用ExecUnique的前提是子节点的元组是有序的。

2、ExecQualAndReset

看下实现的关键函数ExecQualAndReset,该函数通过表达式计算完成数值比较。

表达式的计算步骤为ExprState *eqfunction。由函数ExecInitUnique进行初始化:

相关推荐
小和尚敲木头5 小时前
vue3 vite动态拼接图片路径
javascript
JS菌5 小时前
AI Agent 沙箱双层防护体系:从权限过滤到内核隔离的完整实现
前端·人工智能·后端
Aphasia3115 小时前
从输入URL到页面展示全流程
前端·面试
艾利克斯冰5 小时前
Java 设计模式-行为型模式(更新中)
java·开发语言·设计模式
qq_163135756 小时前
Linux 【07-rm命令超详细教程】
linux
倒霉蛋小马6 小时前
Java新特性:record关键字
java·开发语言
我叫黑大帅6 小时前
前端如何竖屏固定视口背景
前端·javascript·面试
zh路西法6 小时前
【SSH 免密登录全流程】Windows Linux 通用方案
linux·windows·ssh
abcy0712136 小时前
python pandas csv异步后台清洗前端优先返回成功信息
前端·python·pandas
折哥的程序人生 · 物流技术专研6 小时前
《Java 100 天进阶之路》第95篇:消息队列基础(RocketMQ/Kafka)(2026版)
java·面试·kafka·rocketmq·java-rocketmq·求职招聘