408 数据结构|KMP算法核心:为什么不用主串回退

对应章节:串 → 模式匹配 → KMP算法

1. KMP到底解决什么问题

朴素匹配失败后:

复制代码
主串指针回退
模式串重新从头比较

KMP的核心:

主串指针不回退,只让模式串根据已经匹配的信息跳到合适位置。

2. 为什么能跳

假设模式串前面已经匹配成功一部分:

复制代码
主串:   ... A B C A B X ...
模式串:     A B C A B D

前面的:

复制代码
A B C A B

已经匹配成功。

当:

复制代码
X != D

朴素算法会让模式串从头重新试。

KMP不会。

它会看已经匹配成功的部分里,有没有:

复制代码
前缀 = 后缀

如果有,就直接把模式串跳过去继续比较。

3. 什么叫最长相等前后缀

以字符串:

复制代码
ABABA

为例。

前缀:

复制代码
A
AB
ABA
ABAB

后缀:

复制代码
A
BA
ABA
BABA

最长相等前后缀:

复制代码
ABA

长度:

复制代码
3

所以发生失配时,可以保留这3个字符已经匹配的信息。

4. KMP真正利用的是什么

KMP利用的是:

复制代码
模式串自身的结构

也就是提前分析:

复制代码
哪些前缀和后缀相同

然后得到:

复制代码
next数组

5. next数组是干什么的

next数组告诉你:

模式串第 j 个字符失配时,下一个应该去比较模式串的哪个位置。

也就是:

复制代码
失配
↓
查next[j]
↓
模式串跳到新的位置

主串的位置不回退。

6. KMP匹配过程

核心流程:

复制代码
主串字符 == 模式串字符
→ 两个指针一起后移

主串字符 != 模式串字符
→ 主串不动
→ 模式串根据next跳转

7. 为什么KMP比朴素算法快

朴素算法最坏可能达到:

复制代码
O(nm)

KMP匹配时主串基本只向前走。

总复杂度通常写:

复制代码
O(n+m)

其中:

复制代码
n = 主串长度
m = 模式串长度

8. 408最应该记住的三句话

复制代码
1. KMP主串指针不回退
2. 失配后模式串按next数组跳
3. next数组来自模式串的最长相等前后缀

9. 一句话总结

KMP就是:前面白匹配的部分不要浪费,利用模式串自己的前后缀关系,失配后直接跳到最可能继续匹配的位置。

相关推荐
不会就选b1 小时前
数据结构之数&&二叉树(一)
数据结构
努力努力再努力wz1 小时前
【Docker入门系列】:从架构演进到容器化:一文建立 Docker、虚拟化与 Namespace 的底层心智模型
运维·开发语言·数据结构·c++·docker·容器·架构
wuyk5551 小时前
13.堆排序:基于完全二叉树的高效排序算法一、什么是堆排序?
开发语言·算法·排序算法
qinzechen1 小时前
本周科技行业热点汇总·2026第36周(2026年8月31日-9月6日)
c++·科技·算法
白狐_7981 小时前
408 数据结构|红黑树 vs AVL:高频考点、易错判断与可能出题方式
数据结构·算法
zuozong_2 小时前
C++类与对象
开发语言·c++·算法
hansang_IR2 小时前
【代码】分层最短路模板
c++·算法·最短路
啊阿狸不会拉杆2 小时前
《计算机网络-自顶向下方法》5.2 路由选择算法 读书笔记
计算机网络·算法·路由
rannn_1112 小时前
【力扣hot100】多维动态规划|62、64、5、1143、72
算法·leetcode·动态规划