欧美bbbwbbbw肥妇,免费乱码人妻系列日韩,一级黄片

python獲取指定字符串中重復(fù)模式最高的字符串方法

 更新時(shí)間:2018年06月29日 14:30:38   作者:Together_CZ  
今天小編就為大家分享一篇python獲取指定字符串中重復(fù)模式最高的字符串方法,具有很好的參考價(jià)值,希望對大家有所幫助。一起跟隨小編過來看看吧

給定一個(gè)字符串,如何得到其中重復(fù)模式最高的子字符串,我采用的方法是使用滑窗機(jī)制,對給定的字符串切分,窗口的大小從1增加到字符串長度減1,將所有的得到的切片統(tǒng)計(jì)結(jié)果,在這里不考慮單個(gè)字符的重復(fù)模式,好了,很簡單看具體實(shí)現(xiàn):

#!usr/binenv python
#encoding:utf-8
 
'''
__Author__:沂水寒城
統(tǒng)計(jì)一個(gè)給定字符串中重復(fù)模式數(shù)量得到最高重復(fù)模式串
'''
 
def slice(num_str,w):
 '''
 對輸入的字符串滑窗切片返回結(jié)果列表
 '''
 result_list=[]
 for i in range(len(num_str)-w+1):
  result_list.append(num_str[i:i+w])
 return result_list
 
def get_repeat_num_seq(num_str):
 '''
 統(tǒng)計(jì)重復(fù)模式串?dāng)?shù)量
 '''
 result_dict={}
 result_list=[]
 for i in range(2,len(num_str)):
  one_list=slice(num_str, i)
  result_list+=one_list
 for i in range(len(result_list)):
  if result_list[i] in result_dict:
   result_dict[result_list[i]]+=1
  else:
   result_dict[result_list[i]]=1
 sorted_result_dict=sorted(result_dict.items(), key=lambda e:e[1], reverse=True)
 return sorted_result_dict[0:10]
 
if __name__ == '__main__':
 num_list=get_repeat_num_seq('4513785645121214545454545457894')
 print num_list

結(jié)果如下:

[('45', 8), ('4545', 5), ('454', 5), ('545', 5), ('54', 5), ('5454', 4), ('454545', 4), ('45454', 4), ('54545', 4), ('545454', 3)]
[Finished in 0.5s]

結(jié)果列表中第一個(gè)即為所求,當(dāng)然,基于此還可以繼續(xù)改進(jìn)有很多別的需求。

以上這篇python獲取指定字符串中重復(fù)模式最高的字符串方法就是小編分享給大家的全部內(nèi)容了,希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。

相關(guān)文章

最新評論