字符串匹配——kmp算法

简介: 字符串匹配——kmp算法

在文本串(text)中找模式串(pattern)时,如果用暴力查找基本是时间复杂度是(n*m),以i,j分别标志文本串、模式串当前匹配位置,如果text[i]和pattern[j]不等,pattern就要从头比较,实际上模式串的j前面的已经匹配好了,这样就比较浪费信息。

如果j的前几位和pattern开头的前几位相同,那这几位可以不用再比较,而kmp算法正是应用了这个特性,找到pattern当前j位置前几位和pattern开始几位相同的最大个数,减少了比较时间。

怎样描述一下这个最大个数,用一个next数组,next[j]表示pattern字符串第j位前前几位和pattern前几位相同的最大个数。

所以kmp算法的关键就是求一下模式串next数组。

next数组求解的思路是利用已知信息进行递归。

已知i前面的next值,现在看第i+1位,前面最大相等数值位next[i],现在后缀添加了一个字母pattern[i+1],如果前面i最大前缀前缀后一位字母pattern[next[i]]同它相等,显然next[i+1]=next[i]+1;但是不等怎么办!我们要寻找最大相等个数为k,则现在k已经小于next[i]了,我们有不妨找next[i]前面的最大相等位,另k=next[i],去找next[k]=next[i]+1,如此递归到找到或者k已经是起始位了为止。

根据这个思路:

代码如下:


#include<iostream>
#include<cstring>
#include<algorithm>
using namespace std;
const int maxn=10001;
int next[maxn];//next 数组标记位置
void getnext(char s[],int len) {
  int j=-1;
  next[0]=-1;
  for(int i=1;i<len;i++)
  {
    while(j!=-1&&s[i]!=s[j+1])
    j=next[j];
    if(s[i]==s[j+1])
    j++;
    next[i]=j;
  }
}
int kmp(char text[],char pattern[]){
  int ans=0,j=-1,n=strlen(text),m=strlen(pattern);
  getnext(pattern,m);
  for(int i=0;i<n;i++)
  {
    while(j!=-1&&text[i]!=pattern[j+1])
    j=next[j];
    if(text[i]==pattern[j+1])
    j++;
    if(j==m-1){
      ans++;
      j=next[j];
    }
  }
    return ans;
}
int main(){
  char a[]="ababab",b[]="ab";
  int k=kmp(a,b);
  cout<<k;
  return 0;
}
相关文章
|
7月前
|
存储 机器学习/深度学习 算法
KMP、Trie树 、AC自动机‌ ,三大算法实现 优雅 过滤 netty 敏感词
KMP、Trie树 、AC自动机‌ ,三大算法实现 优雅 过滤 netty 敏感词
KMP、Trie树 、AC自动机‌ ,三大算法实现 优雅 过滤 netty  敏感词
|
6月前
|
机器学习/深度学习 监控 算法
局域网行为监控软件 C# 多线程数据包捕获算法:基于 KMP 模式匹配的内容分析优化方案探索
本文探讨了一种结合KMP算法的多线程数据包捕获与分析方案,用于局域网行为监控。通过C#实现,该系统可高效检测敏感内容、管理URL访问、分析协议及审计日志。实验表明,相较于传统算法,KMP在处理大规模网络流量时效率显著提升。未来可在算法优化、多模式匹配及机器学习等领域进一步研究。
199 0
|
算法
两个字符串匹配出最长公共子序列算法
本文介绍了最长公共子序列(LCS)问题的算法实现,通过动态规划方法求解两个字符串的最长公共子序列,并提供了具体的编程实现细节和示例。
309 1
两个字符串匹配出最长公共子序列算法
|
算法 C++
A : DS串应用–KMP算法
这篇文章提供了KMP算法的C++实现,包括计算模式串的next数组和在主串中查找模式串位置的函数,用于演示KMP算法的基本应用。
|
算法
第四章 KMP算法理论基础
第四章 KMP算法理论基础
288 0
|
算法
KMP算法
KMP算法
178 0
|
2月前
|
机器学习/深度学习 算法 机器人
【水下图像增强融合算法】基于融合的水下图像与视频增强研究(Matlab代码实现)
【水下图像增强融合算法】基于融合的水下图像与视频增强研究(Matlab代码实现)
276 0
|
2月前
|
数据采集 分布式计算 并行计算
mRMR算法实现特征选择-MATLAB
mRMR算法实现特征选择-MATLAB
208 2
|
3月前
|
传感器 机器学习/深度学习 编解码
MATLAB|主动噪声和振动控制算法——对较大的次级路径变化具有鲁棒性
MATLAB|主动噪声和振动控制算法——对较大的次级路径变化具有鲁棒性
226 3
|
2月前
|
机器学习/深度学习 算法 机器人
使用哈里斯角Harris和SIFT算法来实现局部特征匹配(Matlab代码实现)
使用哈里斯角Harris和SIFT算法来实现局部特征匹配(Matlab代码实现)
179 8

热门文章

最新文章