【算法知识总结】最长回文子串-Manacher算法

2024-06-03 01:38

本文主要是介绍【算法知识总结】最长回文子串-Manacher算法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

转载自:《简书》曾会玩-最长回文子串问题—Manacher算法
问题说明
最长回文子串问题:给定一个字符串,求它最长回文子串长度。

  1. 方法比较

    Brute-force解法
    对于最长回文子串问题,最简单粗暴的办法是:找到字符串的所有子串,遍历每一个子串以验证它们是否为回文串。一个子串由子串的起点和终点确定,因此对于一个长度为 n n 的字符串,共有n2个子串。这些子串的平均长度大约是 n/2 n / 2 ,因此这个解法的时间复杂度是 O(n3) O ( n 3 )
    .
    改进的方法
    显然所有的回文串都是对称的。长度为奇数回文串以最中间字符的位置为对称轴左右对称,而长度为偶数的回文串的对称轴在中间两个字符之间的空隙。可否利用这种对称性来提高算法效率呢?答案是肯定的。我们知道整个字符串中的所有字符,以及字符间的空隙,都可能是某个回文子串的对称轴位置。可以遍历这些位置,在每个位置上同时向左和向右扩展,直到左右两边的字符不同,或者达到边界。对于一个长度为n的字符串,这样的位置一共有 n+n1=2n1 n + n − 1 = 2 n − 1 个,在每个位置上平均大约要进行 n/4 n / 4 次字符比较,于是此算法的时间复杂度是 O(n2) O ( n 2 )
    .
    Manacher 算法
    对于一个比较长的字符串, O(n2) O ( n 2 ) 的时间复杂度是难以接受的。Can we do better?
    先来看看解法2存在的缺陷。
    .
    1)由于回文串长度的奇偶性造成了不同性质的对称轴位置,解法2要对两种情况分别处理;
    .
    2)很多子串被重复多次访问,造成较差的时间效率。

  2. Manacher算法解决重复访问的问题
    我们把一个回文串中最左或最右位置的字符与其对称轴的距离称为回文半径。 Manacher定义了一个回文半径数组 RL R L ,用 RL[i] R L [ i ] 表示以第 i i 个字符为对称轴的回文串的回文半径。我们一般对字符串从左往右处理,因此这里定义RL[i]为第 i i 个字符为对称轴的回文串的最右一个字符与字符i的距离。对于上面插入分隔符之后的两个串,可以得到 RL R L 数组:

char:    # a # b # a #RL :    1 2 1 4 1 2 1
RL-1:    0 1 0 3 0 1 0i :    0 1 2 3 4 5 6char:    # a # b # b # a #RL :    1 2 1 2 5 2 1 2 1
RL-1:    0 1 0 1 4 1 0 1 0i :    0 1 2 3 4 5 6 7 8

上面我们还求了一下 RL[i]1 R L [ i ] − 1 。通过观察可以发现, RL[i]1 R L [ i ] − 1 的值,正是在原本那个没有插入过分隔符的串中,以位置 i i 为对称轴的最长回文串的长度。那么只要我们求出了RL数组,就能得到最长回文子串的长度。
于是问题变成了,怎样高效地求的 RL R L 数组。基本思路是利用回文串的对称性,扩展回文串。
我们再引入一个辅助变量MaxRight,表示当前访问到的所有回文子串,所能触及的最右一个字符的位置。另外还要记录下MaxRight对应的回文串的对称轴所在的位置,记为pos,它们的位置关系如下。
这里写图片描述

我们从左往右地访问字符串来求 RL R L ,假设当前访问到的位置为 i i ,即要求RL[i],在对应上图, i i 必然是在po右边的(obviously)。但我们更关注的是,i是在MaxRight的左边还是右边。我们分情况来讨论。
1) 当i在MaxRight的左边;
情况1)可以用下图来刻画:
这里写图片描述
我们知道,图中两个红色块之间(包括红色块)的串是回文的;并且以i为对称轴的回文串,是与红色块间的回文串有所重叠的。我们找到 i i 关于pos的对称位置j,这个 j j 对应的RL[j]我们是已经算过的。根据回文串的对称性,以 i i 为对称轴的回文串和以j为对称轴的回文串,有一部分是相同的。这里又有两种细分的情况。

a. 以j为对称轴的回文串比较短,短到像下图这样。
这里写图片描述

这时我们知道 RL[i] R L [ i ] 至少不会小于 RL[j] R L [ j ] ,并且已经知道了部分的以i为中心的回文串,于是可以令 RL[i]=RL[j] R L [ i ] = R L [ j ] 。但是以i为对称轴的回文串可能实际上更长,因此我们试着以i为对称轴,继续往左右两边扩展,直到左右两边字符不同,或者到达边界。
b. 以j为对称轴的回文串很长,这么长:
这里写图片描述

这时,我们只能确定,两条蓝线之间的部分(即不超过MaxRight的部分)是回文的,于是从这个长度开始,尝试以i为中心向左右两边扩展,,直到左右两边字符不同,或者到达边界。
不论以上哪种情况,之后都要尝试更新MaxRight和pos,因为有可能得到更大的MaxRight。
具体操作如下:

step 1: RL[i] <--- min(RL[2*pos-i], MaxRight-i)
step 2: 以i为中心扩展回文串,直到左右两边字符不同,或者到达边界。
step 3: 更新MaxRight和pos

2)当 i i 在MaxRight的右边。
这里写图片描述

遇到这种情况,说明以i为对称轴的回文串还没有任何一个部分被访问过,于是只能从i的左右两边开始尝试扩展了,当左右两边字符不同,或者到达字符串边界时停止。然后更新MaxRight和pos。
.
- 算法实现

def manacher(s):#预处理s='#'+'#'.join(s)+'#'RL=[0]*len(s)MaxRight=0pos=0MaxLen=0for i in range(len(s)):if i<MaxRight:RL[i]=min(RL[2*pos-i], MaxRight-i)else:RL[i]=1#尝试扩展,注意处理边界while i-RL[i]>=0 and i+RL[i]<len(s) and s[i-RL[i]]==s[i+RL[i]]:RL[i]+=1#更新MaxRight,posif RL[i]+i-1>MaxRight:MaxRight=RL[i]+i-1pos=i#更新最长回文串的长度MaxLen=max(MaxLen, RL[i])return MaxLen-1

.
- 复杂度分析
空间复杂度:插入分隔符形成新串,占用了线性的空间大小;RL数组也占用线性大小的空间,因此空间复杂度是线性的。
时间复杂度:尽管代码里面有两层循环,通过 amortizedanalysis a m o r t i z e d a n a l y s i s 我们可以得出, Manacher M a n a c h e r 的时间复杂度是线性的。由于内层的循环只对尚未匹配的部分进行,因此对于每一个字符而言,只会进行一次,因此时间复杂度是 O(n) O ( n )

PS. 好玩儿的Facts(via. wiki)

  • 人们在一座名为赫库兰尼姆的古城遗迹中,找到了一个好玩的拉丁语回文串:sator arepo tenet opera rotas。翻译成中文大概就是`一个叫做Arepo的播种者,他用力地扶(把)着车轮。这个串的每个单词首字母刚好组成了第一个单词,每个单词的第二个字母刚好组成了第二个单词…于是乎,如果写出酱紫,你会发现上下左右四个方向读起来是一样的。这个串被称为 Sator Square.

  • 本文开头给出的单词tattarrattat,出现在爱尔兰作家詹姆斯·乔伊斯的小说《尤利西斯》,是敲门的意思。吉尼斯纪录的最长回文英文单词是detartrated,是个化学术语。另外,还有些已出版的英文回文小说(你们歪果仁真会玩),比如Satire: Veritas,Dr Awkward & Olson in Oslo等。

这篇关于【算法知识总结】最长回文子串-Manacher算法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1025676

相关文章

springboot+dubbo实现时间轮算法

《springboot+dubbo实现时间轮算法》时间轮是一种高效利用线程资源进行批量化调度的算法,本文主要介绍了springboot+dubbo实现时间轮算法,文中通过示例代码介绍的非常详细,对大家... 目录前言一、参数说明二、具体实现1、HashedwheelTimer2、createWheel3、n

SpringBoot实现MD5加盐算法的示例代码

《SpringBoot实现MD5加盐算法的示例代码》加盐算法是一种用于增强密码安全性的技术,本文主要介绍了SpringBoot实现MD5加盐算法的示例代码,文中通过示例代码介绍的非常详细,对大家的学习... 目录一、什么是加盐算法二、如何实现加盐算法2.1 加盐算法代码实现2.2 注册页面中进行密码加盐2.

Java时间轮调度算法的代码实现

《Java时间轮调度算法的代码实现》时间轮是一种高效的定时调度算法,主要用于管理延时任务或周期性任务,它通过一个环形数组(时间轮)和指针来实现,将大量定时任务分摊到固定的时间槽中,极大地降低了时间复杂... 目录1、简述2、时间轮的原理3. 时间轮的实现步骤3.1 定义时间槽3.2 定义时间轮3.3 使用时

java常见报错及解决方案总结

《java常见报错及解决方案总结》:本文主要介绍Java编程中常见错误类型及示例,包括语法错误、空指针异常、数组下标越界、类型转换异常、文件未找到异常、除以零异常、非法线程操作异常、方法未定义异常... 目录1. 语法错误 (Syntax Errors)示例 1:解决方案:2. 空指针异常 (NullPoi

Java反转字符串的五种方法总结

《Java反转字符串的五种方法总结》:本文主要介绍五种在Java中反转字符串的方法,包括使用StringBuilder的reverse()方法、字符数组、自定义StringBuilder方法、直接... 目录前言方法一:使用StringBuilder的reverse()方法方法二:使用字符数组方法三:使用自

国内环境搭建私有知识问答库踩坑记录(ollama+deepseek+ragflow)

《国内环境搭建私有知识问答库踩坑记录(ollama+deepseek+ragflow)》本文给大家利用deepseek模型搭建私有知识问答库的详细步骤和遇到的问题及解决办法,感兴趣的朋友一起看看吧... 目录1. 第1步大家在安装完ollama后,需要到系统环境变量中添加两个变量2. 第3步 “在cmd中

如何通过Golang的container/list实现LRU缓存算法

《如何通过Golang的container/list实现LRU缓存算法》文章介绍了Go语言中container/list包实现的双向链表,并探讨了如何使用链表实现LRU缓存,LRU缓存通过维护一个双向... 目录力扣:146. LRU 缓存主要结构 List 和 Element常用方法1. 初始化链表2.

Python依赖库的几种离线安装方法总结

《Python依赖库的几种离线安装方法总结》:本文主要介绍如何在Python中使用pip工具进行依赖库的安装和管理,包括如何导出和导入依赖包列表、如何下载和安装单个或多个库包及其依赖,以及如何指定... 目录前言一、如何copy一个python环境二、如何下载一个包及其依赖并安装三、如何导出requirem

C++实现回文串判断的两种高效方法

《C++实现回文串判断的两种高效方法》文章介绍了两种判断回文串的方法:解法一通过创建新字符串来处理,解法二在原字符串上直接筛选判断,两种方法都使用了双指针法,文中通过代码示例讲解的非常详细,需要的朋友... 目录一、问题描述示例二、解法一:将字母数字连接到新的 string思路代码实现代码解释复杂度分析三、

Rust格式化输出方式总结

《Rust格式化输出方式总结》Rust提供了强大的格式化输出功能,通过std::fmt模块和相关的宏来实现,主要的输出宏包括println!和format!,它们支持多种格式化占位符,如{}、{:?}... 目录Rust格式化输出方式基本的格式化输出格式化占位符Format 特性总结Rust格式化输出方式