从零开始学TiDB(6)深入学习Placement Driver(PD)

一.PD整体架构

PD的功能:

  1. 元数据的存储(解决执行计划如何得知去哪个region中获取数据)
  2. 全局时钟:查询开始时间,事务开始,结束的时间。
  3. 分配全局ID和事务ID
  4. 对region进行调度(热点region的调度处理)
  5. 提供label,支持高可用
  6. 提供TiDB Dashboard

1.PD 的路由功能

要想知道ledaer region在哪个TIKV,这时候需要问PD节点

但这时候有可能 根据region Cache获取的 leader region有误(可能由于热点region调度,也可能由于region分裂)。这时候请求TiKV 会返回信息,region不在这个TiKV上,在其它节点,TiKV Client再访问其它节点,并更新region cache。 这个过程叫Back off

2.PD的TSO分配

TSO (physical time local time) 课程里是叫这个名字。但很奇怪,为什么官网文档TSO的命名是TimeStamp Oracle??

什么是TSO?

TSO的分配

首先TSO的分配涉及到TiDB Server 和 PD组件

但如果此时TSO有一百个请求,PD Client不会 一次次的请求PD,则PD Client会把这一百个请求变成一个批处理请求发送给PD

相关优化:

PD leader解决性能问题的方法

PD 的高可用

如果此时TiDB Server请求的是704

此时PD ledaer宕机,则切换leader PD,开始一次新的3s计时(即TiDBServer 请求的TSO会有断层,代表此时PD leader 宕机了) ,即保证不了连续性。

三.调度

1.信息调度

2.生成调度

PD 会关注下面的信息,生成调度(operator)。

3.执行调度

PD把调度信息直接发送给region,让region拿着operator 进行调度

四.Label

如果多个region同时失效,则可能会导致数据丢失,这时候可以认为的调整region的分布。这时候需要用到Label。这和Oceanbase 的Zone的逻辑概念有些类似。

给region打标签需要配置两个组件,分别是TiKV 和PD

给region打标签后PD就知道region在哪个数据中心,哪个机房的哪个机架。

相关推荐
程序员雷欧13 小时前
大模型应用开发学习第九天
学习
alien爱吃蛋挞14 小时前
【JavaEE】Linux学习指南:基础命令与项目部署
linux·学习
阿凉070214 小时前
STM32 Flash 扇区分布学习
stm32·嵌入式硬件·学习
我的xiaodoujiao14 小时前
API 接口自动化测试详细图文教程学习系列12--Requests模块4--测试实践操作
python·学习·测试工具·pytest
夜瞬14 小时前
NLP学习笔记06:关系抽取——从规则方法到预训练模型
笔记·学习·自然语言处理
一只机电自动化菜鸟14 小时前
一建机电备考笔记(21):石油化工设备(含考频+易错点)
经验分享·笔记·学习·职场和发展·课程设计
醇氧14 小时前
【学习】深度解析CMM与CMMI能力成熟度模型
学习·cmmi
夜瞬14 小时前
NLP学习笔记07:文本相似度计算——从 TF-IDF 到 BERT
笔记·学习·自然语言处理
海海不掉头发14 小时前
【AI大模型学习基础篇】小白入门大模型全流程:从训练到MCP智能体
人工智能·python·深度学习·学习·语言模型·自然语言处理·numpy
在学了加油14 小时前
ResNet-50学习笔记
笔记·学习