新闻中心
C++怎么实现一个后缀数组(Suffix Array)_C++字符串算法与LCP数组
后缀数组通过排序字符串所有后缀实现高效字符串处理,配合LCP数组可快速求解最长重复子串等问题。

后缀数组(Suffix Array)是处理字符串问题的重要工具,常用于查找最长重复子串、最长回文子串、字符串匹配等场景。它通过对字符串的所有后缀进行排序,得到一个按字典序排列的后缀索引数组。配合LCP(Longest Common Prefix)数组,可以高效解决多种字符串问题。
后缀数组的基本概念
给定一个字符串 S[0..n-1],它的后缀是指从某个位置开始到末尾的子串,即 S[i..n-1]。后缀数组 SA[0..n-1] 是一个整数数组,保存的是使得所有后缀 S[SA[i]..n-1] 按字典序升序排列的起始下标。
例如,S = "banana",其所有后缀为:
- i=0: banana
- i=1: anana
- i=2: nana
- i=3: ana
- i=4: na
- i=5: a
排序后:
- a (i=5)
- ana (i=3)
- anana (i=1)
- banana (i=0)
- na (i=4)
- nana (i=2)
所以 SA = [5, 3, 1, 0, 4, 2]
构造后缀数组:倍增法(Doubling Method)
直接对每个后缀排序时间复杂度为 O(n²logn),效率低。我们可以使用倍增法在 O(n log n) 时间内完成构造。
核心思想:按长度 1, 2, 4, 8... 的前缀对后缀排序,每次利用上一次排序的结果进行快速比较。
步骤如下:
- 初始化:对每个字符排序,得到初始排名 rank[0..n-1]
- 倍增:对于 k = 1, 2, 4, ..., 将每个后缀的排名表示为 pair(rank[i], rank[i+k])
- 重新排序这些 pair,并更新 rank 数组
- 当所有 rank 值唯一时停止
代码实现:
#include <vector>
#include <algorithm>
#include <cstring>
using namespace std;
<p>vector<int> buildSuffixArray(const string& s) {
int n = s.size();
vector<int> sa(n), rank(n), temp(n);</p><pre class='brush:php;toolbar:false;'>// 初始化:按首字符排序
for (int i = 0; i < n; i++) {
sa[i] = i;
rank[i] = s[i];
}
for (int k = 1; k < n; k *= 2) {
auto cmp = [&](int i, int j) {
if (rank[i] != rank[j])
return rank[i] < rank[j];
int ri = (i + k < n) ? rank[i + k] : -1;
int rj = (j + k < n) ? rank[j + k] : -1;
return ri < rj;
};
sort(sa.begin(), sa.end(), cmp);
temp[sa[0]] = 0;
for (int i = 1; i < n; i++) {
temp[sa[i]] = temp[sa[i-1]] + (cmp(sa[i-1], sa[i]) ? 1 : 0);
}
rank = temp;
}
return sa;}
Tunee AI
新一代AI音乐智能体
1104
查看详情
LCP数组:最长公共前缀
LCP[i] 表示后缀 SA[i] 和 SA[i-1] 的最长公共前缀长度(i ≥ 1)。LCP 数组可用于快速查询任意两个后缀的 LCP(配合 RMQ),也能帮助找出最长重复子串。
计算方法:利用 height 数组的性质,通过 SA 和 rank 数组在 O(n) 时间内求出。
LCP数组构造代码:
vector<int> buildLCP(const string& s, const vector<int>& sa) {
int n = s.size();
vector<int> rank(n), lcp(n);
for (int i = 0; i < n; i++)
rank[sa[i]] = i;
<pre class='brush:php;toolbar:false;'>int h = 0;
lcp[0] = 0;
for (int i = 0; i < n; i++) {
if (rank[i] > 0) {
int
j = sa[rank[i] - 1]; // 前一个后缀的起始位置
while (i + h < n && j + h < n && s[i+h] == s[j+h])
h++;
lcp[rank[i]] = h;
if (h > 0) h--;
}
}
return lcp;}
应用示例:查找最长重复子串
利用后缀数组和 LCP 数组,LCP 数组中的最大值即为最长重复子串的长度,对应的位置可还原出具体子串。
例如,在 "banana" 中,LCP 数组为 [0,1,3,0,0,2],最大值为 3,说明存在长度为 3 的重复子串 "ana"。
只需遍历 LCP 数组找到最大值及其位置,再用 SA[i] 取出子串即可。
基本上就这些。后缀数组结合 LCP 能高效处理很多字符串难题,虽然构造稍复杂,但一旦掌握,威力强大。
以上就是C++怎么实现一个后缀数组(Suffix Array)_C++字符串算法与LCP数组的详细内容,更多请关注其它相关文章!
# 升序
# 新乐专业网站推广技巧
# 网站建设相关视频教程
# 泉州个性化营销推广技巧
# 湖州小型网站建设
# 合肥seo工资多少
# 山西网站建设的管理系统
# 德州网站建设健康极速
# 海口整站优化网站
# 台州seo是什么免费
# 淘宝seo实战密码下载
# 也能
# 是指
# c++
# 是一个
# 的是
# 文件系统
# 尼克
# 求出
# 时间内
# 如何使用
# 排列
# ai
# 工具
# go
# 后缀数组
相关栏目:
【
科技资讯46185 】
【
网络学院92790 】
相关推荐:
铁路12306卧铺选择攻略 铁路12306下铺座位预定技巧
微信网页版官方入口教程 微信网页版网页版快速登录步骤
《GTA6》开发画面疑似泄露!这次可不是AI了
Windows电脑怎么截图最方便_系统自带截图工具的5种神仙用法【技巧】
优化大型XML文件解析:基于Python流式处理的内存高效方案
QQ邮箱官方网站登录入口_QQ邮箱网页版在线使用
高德地图怎么看全景照片_高德地图全景照片浏览教程
红果短剧网页版官网入口 官方最新网址发布
蛙漫官方正版入口 蛙漫网页在线全集免费观看
Safari浏览器输入栏卡顿如何解决 Safari搜索建议与缓存清理
Golang并发任务中错误如何聚合_Golang goroutine error收集方式
解决 Vaadin 8 中大文件音频播放与定位时出现的 IOException
Excel Power Pivot如何处理XML数据源 构建高级数据模型
Node.js CSV 数据处理:基于字段空值条件过滤整条记录的策略
b站怎么取消点赞_b站点赞取消操作方法
Node.js中HTML按钮与J*aScript函数交互的正确姿势
Yandex搜索引擎官方地址 俄罗斯网络世界的主要入口
J*a编写用户注册与登录功能_掌握字符串与验证逻辑
小红书网页版入口链接分享 小红书官网直接进
React Router 嵌套组件中 URL 重定向问题的解决方案
妖精漫画网页版登录入口免费_妖精漫画官网主页直接阅读漫画
如何在 Excel Online 和 Google 表格中更改日期格式
QQ邮箱官网登录入口 QQ邮箱网页版邮箱快速登录
创客贴用户入口官网登录 创客贴网页版电脑版系统
Golang如何实现微服务鉴权与权限控制_Golang微服务鉴权与权限管理实践
Word2013如何插入视频和音频媒体_Word2013媒体插入的多媒体支持
PyTorch模型训练效果不佳?深入剖析常见错误与调试技巧
汽水音乐在线解析 汽水音乐在线解析入口
C++编译期如何执行复杂计算_C++模板元编程(TMP)技巧与应用
Win11截图该按哪些键 Win11截屏完整流程解析【教程】
Composer中的^和~符号代表什么_精通Composer版本号语义化约束
C++如何操作注册表_Windows平台下C++读写注册表的API函数详解
C++如何使用AddressSanitizer(ASan)_C++调试工具中检测内存访问错误的利器
Pygame教程:解决用户输入与游戏状态更新不同步问题
PDO预处理语句中冒号的正确处理:区分SQL函数格式与命名占位符
Win11怎么修改默认浏览器_Windows 11设置Chrome为默认
Discord Slash 命令响应超时问题的异步解决方案
Lar*el如何生成PDF或Excel文件_Lar*el文档导出工具与使用教程
DLsite中文平台入口 DLsite官网内容在线查看
如何使用J*aScript精确选择并批量修改特定父元素下子链接的样式
一加手机电池耗电快怎么办_一加手机电池耗电快的解决方法
期待已久:小米17 Ultra、小米首款NAS本月登场
消息称三星明年 2 月正式发布 HBM4,与 SK 海力士同台竞技
如何在更新Composer依赖后自动运行测试_使用post-update-cmd钩子触发PHPUnit
outlook中文官网入口地址 outlook官方中文版直达首页链接
Android Studio计算器C键逻辑错误排查与修复:条件判断优化指南
一加Ace 6T支持全新明眸护眼:通过了最严苛的护眼小金标认证
J*a里如何实现线程安全的懒加载单例_懒加载单例实现方法解析
163邮箱注册官网 免费申请163个人邮箱
小米14应用无法联网原因分析_小米14网络权限修复


2025-12-04
浏览次数:次
返回列表
j = sa[rank[i] - 1]; // 前一个后缀的起始位置
while (i + h < n && j + h < n && s[i+h] == s[j+h])
h++;
lcp[rank[i]] = h;
if (h > 0) h--;
}
}
return lcp;