【LeetCode 刷题】字符串-字符串匹配(KMP)

此博客为《代码随想录》字符串章节的学习笔记,主要内容为字符串匹配 KMP 算法相关的题目解析。

文章目录

  • [28. 找出字符串中第一个匹配项的下标](#28. 找出字符串中第一个匹配项的下标)
  • [459. 重复的子字符串](#459. 重复的子字符串)

28. 找出字符串中第一个匹配项的下标

题目链接

python 复制代码
class Solution:
    def getNext(self, s: str) -> List[int]:
        j, nxt = 0, [0] * len(s)
        for i in range(1, len(s)):
            while j > 0 and s[i] != s[j]:
                j = nxt[j - 1]
            if s[i] == s[j]:
                j += 1
            nxt[i] = j
        return nxt
        
    def strStr(self, haystack: str, needle: str) -> int:
        j, nxt = 0, self.getNext(needle)
        for i in range(len(haystack)):
            while j > 0 and haystack[i] != needle[j]:
                j = nxt[j - 1]
            if haystack[i] == needle[j]:
                j += 1
            if j == len(needle):
                return i - j + 1
        return -1
  • getNext 用于计算 next 数组,next 数组是模式串的特征规律,与文本串无关
  • 在此代码中的 next 数组的定义下,每次遇到矛盾,都需要查找上一个元素next 数组中的值,以确定回溯位置
  • getNext 函数中 j 表示的是目前最长公共前后缀的长度(也指向着公共前缀的末尾);i 指向着公共后缀的末尾
  • getNext 的 for 循环:i 从 1 开始 ,因为 i 为 0 时表示着长度为 1 的串,最长公共前后缀长度为 0,即 next[0] = 0(在数组初始化时已经完成)
  • strStr 的 for 循环:i 从 0 开始 ,完整遍历文本串 haystack

459. 重复的子字符串

题目链接

python 复制代码
class Solution:
    def getNext(self, s: str) -> List[int]:
        j, nxt = 0, [0] * len(s)
        for i in range(1, len(s)):
            while j > 0 and s[i] != s[j]:
                j = nxt[j - 1]
            if s[i] == s[j]:
                j += 1
            nxt[i] = j
        return nxt

    def repeatedSubstringPattern(self, s: str) -> bool:
        nxt = self.getNext(s)
        if nxt[-1] != 0 and len(s) % (len(s) - nxt[-1]) == 0:
            return True
        return False
  • 如果字符串 s 是由重复子串组成,那么最长相等前后缀不包含的子串 一定是 s 的最小重复子串,证明过程
  • 因此仿照 KMP 算法计算 next 数组,判断是否存在最长相等前后缀,以及最长相等前后缀不包含的子串的长度 len(s) - nxt[-1] ,是否能够被原字符串长度整除

移动匹配法(通用做法)

python 复制代码
class Solution:
    def repeatedSubstringPattern(self, s: str) -> bool:
        s_ = (s + s)[1:-1]
        return s in s_
  • 自身加自身得到 s_,之后移除第一和最后一个元素(破坏原始串),判断 s_ 中是否包含自身 s
相关推荐
冷雨夜中漫步4 小时前
Python快速入门(6)——for/if/while语句
开发语言·经验分享·笔记·python
郝学胜-神的一滴4 小时前
深入解析Python字典的继承关系:从abc模块看设计之美
网络·数据结构·python·程序人生
百锦再4 小时前
Reactive编程入门:Project Reactor 深度指南
前端·javascript·python·react.js·django·前端框架·reactjs
颜酱5 小时前
图结构完全解析:从基础概念到遍历实现
javascript·后端·算法
m0_736919106 小时前
C++代码风格检查工具
开发语言·c++·算法
yugi9878386 小时前
基于MATLAB强化学习的单智能体与多智能体路径规划算法
算法·matlab
喵手6 小时前
Python爬虫实战:旅游数据采集实战 - 携程&去哪儿酒店机票价格监控完整方案(附CSV导出 + SQLite持久化存储)!
爬虫·python·爬虫实战·零基础python爬虫教学·采集结果csv导出·旅游数据采集·携程/去哪儿酒店机票价格监控
2501_944934736 小时前
高职大数据技术专业,CDA和Python认证优先考哪个?
大数据·开发语言·python
helloworldandy6 小时前
使用Pandas进行数据分析:从数据清洗到可视化
jvm·数据库·python
DuHz6 小时前
超宽带脉冲无线电(Ultra Wideband Impulse Radio, UWB)简介
论文阅读·算法·汽车·信息与通信·信号处理