摘要
本发明提供了一种基因序列匹配方法、系统、计算机设备及存储介质,属于计算机领域,包括:获取待处理的DNA序列;定义主串S和子串T,确定主串S和子串T存储下标从1开始进行匹配,得到基因序列匹配结果;其中,主串S为完整的DNA序列,子串T为特定的基因片段;其中,当主串S与子串T在第p个字符和第q个字符匹配失败时,利用子串T内部结构信息,通过部分匹配表确定子串T新的比较位置。本发明在匹配失败时,利用部分匹配表(next数组)避免主串指针回溯,有效减少了冗余的字符比较操作,避免了在匹配过程中进行大量重复计算,使得整个基因序列匹配过程更加高效,大幅提升了字符串匹配效率,尤其在处理长字符串和大规模数据时优势显著。