布隆过滤器笔记

课程地址

布隆过滤器由一个很长的二进制向量一系列哈希函数组成

特性:布隆过滤器可以告诉我们 "某样东西一定不存在 或者可能存在",也就是说布隆过滤器说这个数不存在则一定不存在,布隆过滤器说这个数存在可能不存在。这个特性能很好地被用于解决 "Redis 缓存穿透"的问题

原理:使用多个哈希函数将同一个键值映射到不同的位置,所以布隆过滤器的时间复杂度是 O(h),其中 h 是哈希函数的个数

判断是否存在:

python 复制代码
exist = all(bitmap[hash(key)] == 1 for hash in hashers)

事实上,不同的 key 可能被映射到同一个哈希值。例如下面的例子中"你好"和 "hello" 都被映射到下标 2,出现了哈希冲突:

使用多个 hash 函数的目的就是为了避免哈希冲突导致的误判

在实际的布隆过滤器工具包中,误判率是可以配置的,且误判率越低,需要的 bitmap 越长,需要的 hash 函数个数越多,运行时间也越长

布隆过滤器的优点:

  • 速度快,空间省
  • 保密性强,不存储元素本身,只计算哈希

但是受到二进制只能存储 2 种状态的限制,布隆过滤器不能删除元素

相关推荐
二哈赛车手3 小时前
新人笔记---ApiFox的一些常见使用出错
java·笔记·spring
栗子~~4 小时前
JAVA - 二层缓存设计(本地缓冲+redis缓冲+广播所有本地缓冲失效) demo
java·redis·缓存
隔窗听雨眠4 小时前
多活部署、CDN加速与边缘缓存全链路优化实战
缓存
星星也在雾里5 小时前
PgBouncer 解决 PostgreSQL 连接数超限 + 可视化监控
数据库·postgresql
未若君雅裁5 小时前
MyBatis 一级缓存、二级缓存与清理机制
java·缓存·mybatis
xian_wwq6 小时前
【学习笔记】AGC协调控制系统概述
笔记·学习
雨辰AI6 小时前
SpringBoot3 + 人大金仓读写分离 + 分库分表 + 集群高可用 全栈实战
java·数据库·mysql·政务
长城20246 小时前
关于MySql的ONLY_FULL_GROUP_BY问题
数据库·mysql·聚合列
x_yeyue6 小时前
三角形数
笔记·算法·数论·组合数学
常常有7 小时前
MySQL 底层执行原理:输入SQL语句到两阶段提交
数据库·sql·mysql