布隆过滤器笔记

课程地址

布隆过滤器由一个很长的二进制向量一系列哈希函数组成

特性:布隆过滤器可以告诉我们 "某样东西一定不存在 或者可能存在",也就是说布隆过滤器说这个数不存在则一定不存在,布隆过滤器说这个数存在可能不存在。这个特性能很好地被用于解决 "Redis 缓存穿透"的问题

原理:使用多个哈希函数将同一个键值映射到不同的位置,所以布隆过滤器的时间复杂度是 O(h),其中 h 是哈希函数的个数

判断是否存在:

python 复制代码
exist = all(bitmap[hash(key)] == 1 for hash in hashers)

事实上,不同的 key 可能被映射到同一个哈希值。例如下面的例子中"你好"和 "hello" 都被映射到下标 2,出现了哈希冲突:

使用多个 hash 函数的目的就是为了避免哈希冲突导致的误判

在实际的布隆过滤器工具包中,误判率是可以配置的,且误判率越低,需要的 bitmap 越长,需要的 hash 函数个数越多,运行时间也越长

布隆过滤器的优点:

  • 速度快,空间省
  • 保密性强,不存储元素本身,只计算哈希

但是受到二进制只能存储 2 种状态的限制,布隆过滤器不能删除元素

相关推荐
iiiiii111 分钟前
【论文阅读笔记】IDAQ:离线元强化学习中的分布内在线适应
论文阅读·人工智能·笔记·学习·算法·机器学习·强化学习
点亮一颗LED(从入门到放弃)3 分钟前
C语言学习笔记(1)——输入输出,数据类型
c语言·笔记·学习
安卓理事人4 分钟前
安卓临时缓存sp工具类
android·缓存
土拨鼠烧电路11 分钟前
RPA悖论迷思:从解放的利器到运维的枷锁?
大数据·运维·笔记·rpa
DeepFlow 零侵扰全栈可观测11 分钟前
DeepFlow 全栈可观测性 护航某银行核心系统全生命周期
数据库·人工智能·分布式·云原生·金融
e***582314 分钟前
C#数据库操作系列---SqlSugar完结篇
网络·数据库·c#
IMPYLH14 分钟前
Lua 的 select 函数
java·开发语言·笔记·后端·junit·游戏引擎·lua
云半S一15 分钟前
春招准备之测试基础理论篇
经验分享·笔记·功能测试·测试覆盖率
L***p31316 分钟前
MYSQL的第一次
数据库·mysql
Y***985116 分钟前
MySQL下载安装及配置
数据库·mysql