408 数据结构|KMP算法核心:为什么不用主串回退

对应章节:串 → 模式匹配 → KMP算法

1. KMP到底解决什么问题

朴素匹配失败后:

复制代码
主串指针回退
模式串重新从头比较

KMP的核心:

主串指针不回退,只让模式串根据已经匹配的信息跳到合适位置。

2. 为什么能跳

假设模式串前面已经匹配成功一部分:

复制代码
主串:   ... A B C A B X ...
模式串:     A B C A B D

前面的:

复制代码
A B C A B

已经匹配成功。

当:

复制代码
X != D

朴素算法会让模式串从头重新试。

KMP不会。

它会看已经匹配成功的部分里,有没有:

复制代码
前缀 = 后缀

如果有,就直接把模式串跳过去继续比较。

3. 什么叫最长相等前后缀

以字符串:

复制代码
ABABA

为例。

前缀:

复制代码
A
AB
ABA
ABAB

后缀:

复制代码
A
BA
ABA
BABA

最长相等前后缀:

复制代码
ABA

长度:

复制代码
3

所以发生失配时,可以保留这3个字符已经匹配的信息。

4. KMP真正利用的是什么

KMP利用的是:

复制代码
模式串自身的结构

也就是提前分析:

复制代码
哪些前缀和后缀相同

然后得到:

复制代码
next数组

5. next数组是干什么的

next数组告诉你:

模式串第 j 个字符失配时,下一个应该去比较模式串的哪个位置。

也就是:

复制代码
失配
↓
查next[j]
↓
模式串跳到新的位置

主串的位置不回退。

6. KMP匹配过程

核心流程:

复制代码
主串字符 == 模式串字符
→ 两个指针一起后移

主串字符 != 模式串字符
→ 主串不动
→ 模式串根据next跳转

7. 为什么KMP比朴素算法快

朴素算法最坏可能达到:

复制代码
O(nm)

KMP匹配时主串基本只向前走。

总复杂度通常写:

复制代码
O(n+m)

其中:

复制代码
n = 主串长度
m = 模式串长度

8. 408最应该记住的三句话

复制代码
1. KMP主串指针不回退
2. 失配后模式串按next数组跳
3. next数组来自模式串的最长相等前后缀

9. 一句话总结

KMP就是:前面白匹配的部分不要浪费,利用模式串自己的前后缀关系,失配后直接跳到最可能继续匹配的位置。

相关推荐
倒头就睡的小比特5 天前
算法竞赛C++常用的STL
c++·算法
小羊没烦恼!5 天前
初探性能优化——2个月到4小时的性能提升
java·开发语言·windows·算法·c#
猎头南楼5 天前
知识社区推荐系统实践:新用户冷启动与长短期兴趣建模的挑战 资深推荐算法工程师
人工智能·深度学习·算法·机器学习
m0_547486665 天前
《数据结构教程》全套 PPT课件2026
数据结构
旖旎夜光5 天前
力控面试题 01.01: 判定字符是否唯一(位运算) —— 题解
c++·学习·算法·leetcode·力控
wzdark5 天前
大规模并行计算中的负载均衡算法研究4
算法
Because_of_Her15 天前
并查集-听课笔记
笔记·算法·并查集
码流子5 天前
高速公路安全监测实践:碰撞监测预警+物联网底座,从感知到处置的闭环
大数据·人工智能·物联网·算法·架构
another heaven5 天前
【算法/C++ MD5算法能否逆解码?原理、C++实现与同类哈希算法对比】
c++·算法·哈希算法
wzdark5 天前
从算法设计模式看编程思维的抽象能力4
算法