【字符串】后缀自动机 - 模板

2024-08-23 04:28

本文主要是介绍【字符串】后缀自动机 - 模板,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

解决字符串中子串的相关问题

/*******************后缀自动机SAM***********************
- 总点数tot,点的index属于[1-tot],空串/根为1
- last为上一次插入的点
- fa为点的parent树父节点 / 最长 出现位置与自己不同 的后缀
- ch[n][s] 指节点n末尾加字符s所转移到的点
- len指该节点的串的 最长长度,注意到 最短长度 等于 len[fa[n]] + 1 即父节点最长 + 1
- endpos[n] 参考get_endpos()的注释
*/struct SAM
{static const int MAXN = 1e6 + 10, MAXS = 27;int tot = 1, last = 1, fa[MAXN << 1], ch[MAXN << 1][MAXS], len[MAXN << 1], endpos[MAXN << 1];void clear(){for (int i = 0; i <= tot; i++){fa[i] = len[i] = endpos[i] = 0;for (int k = 0; k < MAXS; k++)ch[i][k] = 0;}tot = 1;last = 1;}// 延长一个字符,注意输入的是转换后的数字void extend(int w){int p = ++tot, x = last, r, q;endpos[p] = 1;for (len[last = p] = len[x] + 1; x && !ch[x][w]; x = fa[x])ch[x][w] = p;if (!x)fa[p] = 1;else if (len[x] + 1 == len[q = ch[x][w]])fa[p] = q;else{fa[r = ++tot] = fa[q];memcpy(ch[r], ch[q], sizeof ch[r]);len[r] = len[x] + 1;fa[p] = fa[q] = r;for (; x && ch[x][w] == q; x = fa[x])ch[x][w] = r;}}//*注意vector占用的空间vector<int> p[MAXN << 1]; // 建立parent树,以便从上到下dfsvoid dfs(int u){int v;for (int i = 0; i < p[u].size(); i++){v = p[u][i];dfs(v);endpos[u] += endpos[v];}}// 注意: 在使用该方法前,endpos[]代表每个点作为“终结点”的次数// 使用该方法后,endpos[]指在串中出现总次数,即原数组的子树求和void get_endpos(){for (int i = 1; i <= tot; i++)p[i].clear();for (int i = 2; i <= tot; i++){p[fa[i]].push_back(i); // 建立parent树,以便从上到下dfs}dfs(1);for (int i = 1; i <= tot; i++)p[i].clear();}//* 确认是否有抄写错误时使用该方法//* 必须在输入任何数据前自检,此前的数据会被清空static const int STC = 998244353;void self_test(){clear();for (int i = 1; i <= 1000; i++)extend(i * i % 26 + 1);int tmp = 107 * last + 301 * tot;for (int i = 1; i <= tot; i++){tmp = (tmp * 33 + fa[i] * 101 + len[i] * 97) % STC;for (int k = 1; k < MAXS; k++)tmp = (tmp + k * ch[i][k]) % STC;}assert("stage 1" && tmp == 393281314); // stage1 : 检查建树是否正确tmp = 0;get_endpos();for (int i = 1; i <= tot; i++)tmp = (tmp * 33 + endpos[i]) % STC;assert("stage 2" && tmp == 178417668); // stage2 : 检查endpos计算是否正确,如果您修改了endpos[]的含义则会报错cout << "Self Test Passed.Remember to delete this function's use." << endl;clear();}// 调试时调用void debug_print(){cout << '\n';for (int i = 1; i <= tot; i++){cout << "node:" << i << " father:" << fa[i] << " endpos:" << endpos[i] << " len:" << len[i] << '\n';}}void solve(){// 这里输入解题逻辑// - 建树string s; cin >> s;clear();for (auto t : s) extend(t - 'a');// - get_endpos()get_endpos();// - 求解}
} sam;// *************************************************

这篇关于【字符串】后缀自动机 - 模板的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1098347

相关文章

JAVA中整型数组、字符串数组、整型数和字符串 的创建与转换的方法

《JAVA中整型数组、字符串数组、整型数和字符串的创建与转换的方法》本文介绍了Java中字符串、字符数组和整型数组的创建方法,以及它们之间的转换方法,还详细讲解了字符串中的一些常用方法,如index... 目录一、字符串、字符数组和整型数组的创建1、字符串的创建方法1.1 通过引用字符数组来创建字符串1.2

C#中字符串分割的多种方式

《C#中字符串分割的多种方式》在C#编程语言中,字符串处理是日常开发中不可或缺的一部分,字符串分割是处理文本数据时常用的操作,它允许我们将一个长字符串分解成多个子字符串,本文给大家介绍了C#中字符串分... 目录1. 使用 string.Split2. 使用正则表达式 (Regex.Split)3. 使用

Java中JSON字符串反序列化(动态泛型)

《Java中JSON字符串反序列化(动态泛型)》文章讨论了在定时任务中使用反射调用目标对象时处理动态参数的问题,通过将方法参数存储为JSON字符串并进行反序列化,可以实现动态调用,然而,这种方式容易导... 需求:定时任务扫描,反射调用目标对象,但是,方法的传参不是固定的。方案一:将方法参数存成jsON字

poj3468(线段树成段更新模板题)

题意:包括两个操作:1、将[a.b]上的数字加上v;2、查询区间[a,b]上的和 下面的介绍是下解题思路: 首先介绍  lazy-tag思想:用一个变量记录每一个线段树节点的变化值,当这部分线段的一致性被破坏我们就将这个变化值传递给子区间,大大增加了线段树的效率。 比如现在需要对[a,b]区间值进行加c操作,那么就从根节点[1,n]开始调用update函数进行操作,如果刚好执行到一个子节点,

C++11第三弹:lambda表达式 | 新的类功能 | 模板的可变参数

🌈个人主页: 南桥几晴秋 🌈C++专栏: 南桥谈C++ 🌈C语言专栏: C语言学习系列 🌈Linux学习专栏: 南桥谈Linux 🌈数据结构学习专栏: 数据结构杂谈 🌈数据库学习专栏: 南桥谈MySQL 🌈Qt学习专栏: 南桥谈Qt 🌈菜鸡代码练习: 练习随想记录 🌈git学习: 南桥谈Git 🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈🌈�

poj 1258 Agri-Net(最小生成树模板代码)

感觉用这题来当模板更适合。 题意就是给你邻接矩阵求最小生成树啦。~ prim代码:效率很高。172k...0ms。 #include<stdio.h>#include<algorithm>using namespace std;const int MaxN = 101;const int INF = 0x3f3f3f3f;int g[MaxN][MaxN];int n

uva 1342 欧拉定理(计算几何模板)

题意: 给几个点,把这几个点用直线连起来,求这些直线把平面分成了几个。 解析: 欧拉定理: 顶点数 + 面数 - 边数= 2。 代码: #include <iostream>#include <cstdio>#include <cstdlib>#include <algorithm>#include <cstring>#include <cmath>#inc

uva 11178 计算集合模板题

题意: 求三角形行三个角三等分点射线交出的内三角形坐标。 代码: #include <iostream>#include <cstdio>#include <cstdlib>#include <algorithm>#include <cstring>#include <cmath>#include <stack>#include <vector>#include <

poj 2104 and hdu 2665 划分树模板入门题

题意: 给一个数组n(1e5)个数,给一个范围(fr, to, k),求这个范围中第k大的数。 解析: 划分树入门。 bing神的模板。 坑爹的地方是把-l 看成了-1........ 一直re。 代码: poj 2104: #include <iostream>#include <cstdio>#include <cstdlib>#include <al

hdu 3065 AC自动机 匹配串编号以及出现次数

题意: 仍旧是天朝语题。 Input 第一行,一个整数N(1<=N<=1000),表示病毒特征码的个数。 接下来N行,每行表示一个病毒特征码,特征码字符串长度在1—50之间,并且只包含“英文大写字符”。任意两个病毒特征码,不会完全相同。 在这之后一行,表示“万恶之源”网站源码,源码字符串长度在2000000之内。字符串中字符都是ASCII码可见字符(不包括回车)。