本文主要是介绍飘逸的python - 字符串的KMP匹配算法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!
首先我们来看一下字符串的朴素匹配.可以想象成把文本串s固定住,模式串p从s最左边开始对齐,如果对齐的部分完全一样,则匹配成功,失败则将模式串p整体往右移1位,继续检查对齐部分,如此反复.
#朴素匹配
def naive_match(s, p):m = len(s); n = len(p)for i in range(m-n+1):#起始指针iif s[i:i+n] == p:return Truereturn False
关于kmp算法,讲的最好的当属阮一峰的< 字符串匹配的KMP算法>.一路读下来,豁然开朗.
其实就是, 对模式串p进行预处理,得到前后缀的部分匹配表,使得我们可以借助已知信息,算出可以右移多少位.即 kmp = 朴素匹配 + 移动多位.
更多细节请看阮一峰的文章,这里就不展开了.
下面给出python的代码实现.
#KMP
def kmp_match(s, p):m = len(s); n = len(p)cur = 0#起始指针curtable = partial_table(p)while cur<=m-n:for i in range(n):if s[i+cur]!=p[i]:cur += max(i - table[i-1], 1)#有了部分匹配表,我们不只是单纯的1位1位往右移,可以一次移动多位breakelse:return Truereturn False#部分匹配表
def partial_table(p):'''partial_table("ABCDABD") -> [0, 0, 0, 0, 1, 2, 0]'''prefix = set()postfix = set()ret = [0]for i in range(1,len(p)):prefix.add(p[:i])postfix = {p[j:i+1] for j in range(1,i+1)}ret.append(len((prefix&postfix or {''}).pop()))return retprint naive_match("BBC ABCDAB ABCDABCDABDE", "ABCDABD")
print partial_table("ABCDABD")
print kmp_match("BBC ABCDAB ABCDABCDABDE", "ABCDABD")
这篇关于飘逸的python - 字符串的KMP匹配算法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!