布隆过滤器笔记

课程地址

布隆过滤器由一个很长的二进制向量一系列哈希函数组成

特性:布隆过滤器可以告诉我们 "某样东西一定不存在 或者可能存在",也就是说布隆过滤器说这个数不存在则一定不存在,布隆过滤器说这个数存在可能不存在。这个特性能很好地被用于解决 "Redis 缓存穿透"的问题

原理:使用多个哈希函数将同一个键值映射到不同的位置,所以布隆过滤器的时间复杂度是 O(h),其中 h 是哈希函数的个数

判断是否存在:

python 复制代码
exist = all(bitmap[hash(key)] == 1 for hash in hashers)

事实上,不同的 key 可能被映射到同一个哈希值。例如下面的例子中"你好"和 "hello" 都被映射到下标 2,出现了哈希冲突:

使用多个 hash 函数的目的就是为了避免哈希冲突导致的误判

在实际的布隆过滤器工具包中,误判率是可以配置的,且误判率越低,需要的 bitmap 越长,需要的 hash 函数个数越多,运行时间也越长

布隆过滤器的优点:

  • 速度快,空间省
  • 保密性强,不存储元素本身,只计算哈希

但是受到二进制只能存储 2 种状态的限制,布隆过滤器不能删除元素

相关推荐
遗憾皆是温柔15 分钟前
MyBatis—动态 SQL
java·数据库·ide·sql·mybatis
IT从业者张某某18 分钟前
信奥赛-刷题笔记-队列篇-T3-P3662Why Did the Cow Cross the Road II S
android·笔记
未来之窗软件服务36 分钟前
Cacti 未经身份验证SQL注入漏洞
android·数据库·sql·服务器安全
小秋学嵌入式-不读研版1 小时前
C42-作业练习
c语言·开发语言·笔记
田梓燊1 小时前
数学复习笔记 14
笔记·线性代数·矩阵
fengye2071611 小时前
在MYSQL中导入cookbook.sql文件
数据库·mysql·adb
hudawei9961 小时前
flutter缓存网络视频到本地,可离线观看
flutter·缓存·音视频
小哈里1 小时前
【pypi镜像源】使用devpi实现python镜像源代理(缓存加速,私有仓库,版本控制)
开发语言·python·缓存·镜像源·pypi
_Jyuan_1 小时前
尼康VR镜头防抖模式NORMAL和ACTIVE的区别(私人笔记)
经验分享·笔记·数码相机·相机
m0_678693331 小时前
深度学习笔记23-LSTM实现火灾预测(Tensorflow)
笔记·深度学习·lstm