Sunday 算法详解
创始人
2024-03-24 13:34:19
0

Sunday 算法

Sunday算法是Daniel M.Sunday于1990年提出的字符串模式匹配。其核心思想是:在匹配过程中,模式串发现不匹配时,算法能跳过尽可能多的字符以进行下一步的匹配,从而提高了匹配效率。

一、匹配机制

匹配机制非常容易理解:

  • 目标字符串 String
  • 模式串 Pattern
  • 当前查询索引 idx (初始为 0)
  • 待匹配字符串 str_cut : String [ idx : idx + len(Pattern) ]

每次匹配都会从 目标字符串中 提取 待匹配字符串模式串 进行匹配:

  • 若匹配,则返回当前 idx
  • 不匹配,则查看 待匹配字符串 的后一位字符 c
    1. c 存在于 Pattern 中,则 idx = idx + 偏移表[c]
    2. 否则,idx = idx + len(pattern)

循环上述匹配过程直到 idx + len(pattern) > len(String)

二、偏移表

偏移表的作用是存储每一个在 模式串 中出现的字符,在 模式串 中出现的最右位置到尾部的距离 +1,例如 aab:

  • a 的偏移位就是 len(pattern)-1 = 2
  • b 的偏移位就是 len(pattern)-2 = 1
  • 其他的均为 len(pattern)+1 = 4

综合一下:

shift[w]={m−max{im−max{i

三、举例

String: checkthisout Pattern: this

Step 1:
在这里插入图片描述

  • idx = 0
  • 待匹配字符串为:chec
  • 因为 chec != this
  • 所以查看 chec 的下一个字符 k
  • k 不在 Pattern 里
  • 所以查看 偏移表idx = idx + 5

Step 2:
在这里插入图片描述

  • idx = 5
  • 待匹配字符串为:this
  • 因为 this == this
  • 匹配,所以返回 5

四、算法分析

时间复杂度: 最坏情况 O(nm)O(nm)O(nm) ,平均情况 O(n)O(n)O(n)
空间复杂度: O(c)O(c)O(c),c为位移表长度

五、代码实现

class Solution:def strStr(self, haystack, needle):haystack_length = len(haystack)needle_length = len(needle)return self.sunday(haystack, haystack_length, needle, needle_length)def sunday(self, s, s_len, p, p_len):bc_move_dict = self.badChatMove(p, p_len)now = 0# 如果匹配字符的位置到达两字符串长度的差值,则不可能存在匹配字串,则退出循环while now <= s_len - p_len:# 比对当前位置的子串是否和模式串匹配if s[now: now+p_len] == p:return now# 如果以及到达两字符串长度的差值,那么这将是最后一个可能匹配到的子串# 经过上面的比对没有匹配的话,直接返回-1if now == s_len - p_len:return -1# 更新下标,如果模式串不包含匹配串后面的第一个字符,则移动 p_len+1 个位数now += bc_move_dict.get(s[now+p_len], p_len+1)return -1# 坏字符移动数量计算def badChatMove(self, p, p_len):bc_move_dict = dict()for i in range(p_len):# 记录该字符在模式串中出现的最右位置到尾部的距离+1bc_move_dict[p[i]] = p_len - ireturn bc_move_dict

参考文章

<>

相关内容

热门资讯

不能访问光猫的的管理页面 光猫是现代家庭宽带网络的重要组成部分,它可以提供高速稳定的网络连接。但是,有时候我们会遇到不能访问光...
【NI Multisim 14...   目录 序言 一、工具栏 🍊1.“标准”工具栏 🍊 2.视图工具...
Android|无法访问或保存... 这个问题可能是由于权限设置不正确导致的。您需要在应用程序清单文件中添加以下代码来请求适当的权限:此外...
银河麒麟V10SP1高级服务器... 银河麒麟高级服务器操作系统简介: 银河麒麟高级服务器操作系统V10是针对企业级关键业务...
北信源内网安全管理卸载 北信源内网安全管理是一款网络安全管理软件,主要用于保护内网安全。在日常使用过程中,卸载该软件是一种常...
​ToDesk 远程工具安装及... 目录 前言 ToDesk 优势 ToDesk 下载安装 ToDesk 功能展示 文件传输 设备链接 ...
AWSECS:访问外部网络时出... 如果您在AWS ECS中部署了应用程序,并且该应用程序需要访问外部网络,但是无法正常访问,可能是因为...
APK正在安装,但应用程序列表... 这个问题可能是由于以下原因导致的:应用程序安装的APK文件可能存在问题。设备上已经存在同名的应用程序...
安卓文字转语音tts没有声音 安卓文字转语音TTS没有声音的问题在应用中比较常见,通常是由于一些设置或者代码逻辑问题导致的。本文将...
报告实验.pdfbase.tt... 这个错误通常是由于找不到字体文件或者文件路径不正确导致的。以下是一些解决方法:确认字体文件是否存在:...