为什么Mysql用B+树作为索引

首先,能作为索引的数据结构有很多,例如数组、链表、二叉树
数据和索引都是存储在磁盘里的。
我们通过索引来查询数据时,先从磁盘读取索引到内存,再通过索引从磁盘中找到某行数据,然后读入到内存。
要设计一个适合 MySQL 索引的数据结构,至少满足以下要求:

  • 能在尽可能少的磁盘的 I/O 操作中完成查询工作;

  • 要能高效地查询某一个记录,也要能高效地执行范围查找;
    数组:
    优点:用数组可以实现二分查找,时间复杂度从On降到Ologn
    缺点:

  • 每次查找都要不断计算中间的位置。

  • 但是插入新元素的时候性能太低。(元素之后的所有元素后移一位)
    二叉搜索树:
    优点:(解决了数组的2个缺点)

  • 每次查找只需要作比较即可

  • 插入新元素时,可以任意位置插入,不需要将之后元素所有后移一位。
    缺点:

  • 当每次插入的元素都是二叉查找树中最大的元素,二叉查找树就会退化成了一条链表,查找数据的时间复杂度变成了 O(n)

  • 每访问一次节点,都要与磁盘进行一次IO操作。而树的高度就时访问节点的次数,二叉树的高度太容易高了,所以增加了IO。
    自平衡二叉树:
    优点:

  • 解决了二叉查找树就会退化成了一条链表的问题
    缺点:

  • 高度问题依旧存在
    需要解决高度问题,首先想到将二叉树变为M叉树,由此想到了B树
    B树:
    优点:

  • 解决了高度问题
    缺点:

  • 但是 B 树的每个节点都包含数据(索引+记录),而用户的记录数据的大小很有可能远远超过了索引数据,这就需要花费更多的磁盘 I/O 操作次数来读到「有用的索引数据」。

  • 而且,在我们查询位于底层的某个节点(比如 A 记录)过程中,「非 A 记录节点」里的记录数据会从磁盘加载到内存,但是这些记录数据是没用的,我们只是想读取这些节点的索引数据来做比较查询,而「非 A 记录节点」里的记录数据对我们是没用的,这样不仅增多磁盘 I/O 操作次数,也占用内存资源。

  • 如果使用 B 树来做范围查询的话,需要使用中序遍历,这会涉及多个节点的磁盘 I/O 问题,从而导致整体速度下降。
    B+树:
    优点:

  • B+树的非叶子节点可以存放更多的索引,在数据量相同的情况下,B+树会比B树的高度更低。

  • B+ 树有许多冗余节点,而B树没有,这就使得B+树的插入和删除效率更高

  • B+ 树所有叶子节点间还有一个链表进行连接,可以据此进行范围的查询,不用像B树一样只能遍历查询

相关推荐
Wang's Blog6 分钟前
Java框架快速入门: Spring Security+OAuth2之邮件验证码发送(SMTP与API方式)
java·数据库·spring
砚底藏山河1 小时前
容错重试与指数退避:网络抖动手抖不再丢数据(魔码量化实战 #04)
java·数据库·python·金融
蓝速科技2 小时前
会议室门牌触控预约选型与落地实战指南丨蓝速科技
大数据·运维·数据库·人工智能·科技
YIAN2 小时前
手撸社区后端:一套可落地的用户 - 文章 - 互动体系 MySQL 表设计与优化思路
后端·mysql
蓝速科技2 小时前
企业展厅数字人导览效果提升与选型实战指南丨蓝速科技
大数据·运维·数据库·人工智能·科技·microsoft
奔跑吧树袋熊2 小时前
多租户隔离该做到哪一层:从连接池到 ORM 的取舍
开发语言·数据库·oracle·系统架构
码农学院2 小时前
零售电商GEO踩坑复盘:把 MySQL 商品库自动映射成 Product Schema 的完整方案
人工智能·mysql·零售·geo
罗光记2 小时前
全能 Go Agent 框架 Covonaut v1.1.2发布:终端对话加入旁问与三档输出
数据库·经验分享·其他·百度·新浪微博
Htr_3 小时前
Anysite.io 使用指南:把整个 Web 变成 AI 智能体的数据库
前端·数据库·人工智能
Lyra_Infra3 小时前
记一次麒麟 Linux 下达梦数据库 (DM8) 部署与 MySQL 命令行无界面迁移踩坑指南
数据库·后端·dba