最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python實現(xiàn)的正則表達式功能入門教程【經(jīng)典】

 更新時間:2017年06月05日 11:36:12   作者:九茶  
這篇文章主要介紹了python實現(xiàn)的正則表達式功能,詳細分析了Python正則表達式中常用的各種符號、函數(shù)等的使用方法與注意事項,需要的朋友可以參考下

本文講述了python實現(xiàn)的正則表達式功能。分享給大家供大家參考,具體如下:

前文:

首先,什么叫正則表達式(Regular Expression)?

例如我們要判斷字符串"adi_e32fv,Ls"里面是否含有子串"e32f",又例如我們在一個含百萬個姓名的txt文件中找姓“王”,名字以“五”結(jié)尾的名字,然后打印出來。結(jié)果為:“王五”、“王小五”、“王大五”、“王小小五”……

以前我們是使用字符串函數(shù)來查找的,但是代碼實現(xiàn)起來會很復(fù)雜。如今用正則表達式只需要一句 re.findall('王.*?五',txt1) 就可以了!正則表達式是寫網(wǎng)絡(luò)爬蟲的最基本的知識,可以用正則表達式在html中搜集滿足某些字串要求的網(wǎng)址。下面是個人對正則表達式基礎(chǔ)知識的一些總結(jié)。

(操作環(huán)境:32位Win8系統(tǒng),運行工具:python2.7.9+Eclipse.)

正文:

1、首先要導(dǎo)入python的re模塊。

2、元字符 . ^ $ * + ? {} [] \ | ()

re模塊中的findall(str1,str2)方法返回字串str2中匹配str1格式的字串。例如在字符串'dit dot det,dct dit dot'中匹配'dit'結(jié)果為:

str1 = 'dit dot det,dct dit dot'
print re.findall('dit',str1)

結(jié)果:

['dit', 'dit']

|作用:'dit|dct'表示dit或者dct。

str1 = 'dit dot det,dct dit dot'
print re.findall('dit|dct',str1)

結(jié)果:

['dit', 'dct', 'dit']

[]作用:[ic]表示i或c,例如'd[ic]t'表示dit和dct兩者,和'dit|dct'等價:

str1 = 'dit dot det,dct dit dot'
print re.findall('d[ic]t',str1)

結(jié)果:

['dit', 'dct', 'dit']

^作用一:[^ic]中^表示否定,即除了i和c:

str1 = 'dit dot det,dct dit dot'
print re.findall('d[^ic]t',str1)

結(jié)果:

['dot', 'det', 'dot']

^作用二:^dit表示子串dit在開頭位置,而dct不是在開頭:

str1 = 'dit dot det,dct dit dot'
print re.findall('^dit',str1)
print re.findall('^dct',str1)

結(jié)果:

['dit'][]

$作用:dot$表示子串dot要在末尾位置,而dct不是在末尾:

str1 = 'dit dot det,dct dit dot'
print re.findall('dot$',str1)
print re.findall('dct$',str1)

結(jié)果:

['dot'][]

.作用:d.t表示d與t之間省略了一個任意字符:

str1 = 'dit dot det,dct dit dot'
print re.findall('d.t',str1)

結(jié)果:

['dit', 'dot', 'det', 'dct', 'dit', 'dot']

+作用:di+t表示d與t之間省略了一個或多個'i':

str1 = 'd dt dit diit det'
print re.findall('d.+t',str1)

結(jié)果:

['dit', 'diit']

*作用:di*t表示d與t之間省略了零個至多個'i':

str1 = 'd dt dit diit det'
print re.findall('d.*t',str1)

結(jié)果:

['dt', 'dit', 'diit']

經(jīng)常,'.'和'+'或者'*'搭配使用。'.+'表示省略了一個至多個任意元素,'.*'表示省略了零個至多個任意元素:

str1 = 'd dt dit diit det'
print re.findall('d.+t',str1)
print re.findall('d.*t',str1)

結(jié)果:

['d dt dit diit det']['d dt dit diit det']

?作用一:看.+的匹配結(jié)果,'dit'、'dot'也滿足'd.+t'的匹配條件,而輸出的卻是滿足匹配條件的最長子串'dit dot det,dct dit dot',這個叫貪婪匹配。如果要輸出最短的匹配字串,只需在'+'后面加上'?':(注:對于'*'也是一樣,只需在'*'后面加上'?')

str1 = 'd dt dit diit det'
print re.findall('d.+?t',str1)

結(jié)果:

['dit', 'dot', 'det', 'dct', 'dit', 'dot']

?作用二:di?t表示i可有可無,即dt、dit都滿足匹配條件:

str1 = 'd dt dit diit det'
print re.findall('di?t',str1)

結(jié)果:

['dt', 'dit']

{}作用一:di{n}t表示d和t之間有n個'i':

str1 = 'dt dit diit diiit diiiit'
print re.findall('di{2}t',str1)

結(jié)果:

['diit']

{}作用二:di{n,m}t表示d和t之間有n到m個'i':

str1 = 'dt dit diit diiit diiiit'
print re.findall('di{1,3}t',str1)

結(jié)果:

['dit', 'diit', 'diiit']

其中,n和m都是可以省略的。{n,}表示n個到任意個;{,m}表示0個到m個;{,}表示任意個,和'*'功能一樣:

str1 = 'dt dit diit diiit diiiit'
print re.findall('di{1,}t',str1)
print re.findall('di{,3}t',str1)
print re.findall('di{,}t',str1)

結(jié)果:

['dit', 'diit', 'diiit', 'diiiit']
   ['dt', 'dit', 'diit', 'diiit']
   ['dt', 'dit', 'diit', 'diiit', 'diiiit']

\作用一:取消元字符,變成轉(zhuǎn)義字符:

str1 = '^abc ^abc'
print re.findall('^abc',str1)
print re.findall('\^abc',str1)

結(jié)果:

[]['^abc', '^abc']

\作用二:預(yù)定義字符

str1 = '12 abc 345 efgh'
print re.findall('\d+',str1)
print re.findall('\w+',str1)

結(jié)果:

['12', '345']
   ['12', 'abc', '345', 'efgh']

()作用:在匹配字符串后,只輸出匹配字串'()'里面的內(nèi)容:

str1 = '12abcd34'
print re.findall('12abcd34',str1)
print re.findall('1(2a)bcd34',str1)
print re.findall('1(2a)bc(d3)4',str1)

結(jié)果:

['12abcd34']
   ['2a']
   [('2a', 'd3')]

3、re模塊里的主要方法:findall()、finditer()、match()、search()、compile()、split()、sub()、subn()。

re.findall(pattern,string,flags = 0)

作用:在string中從左往右搜索與pattern匹配的字串,結(jié)果以list形式返回。

str1 = 'ab cd'
print re.findall('\w+',str1)

結(jié)果:['ab', 'cd']

re.finditer(pattern,string,flags = 0)

作用:其功能與re.findall相同,但結(jié)果以迭代器的形式返回。

str1 = 'ab cd'
iter1 = re.finditer('\w+',str1)
for a in iter1:
  print a.group(),a.span()

結(jié)果:

ab (0, 2)
      cd (3, 5)

(注:a.group()返回滿足匹配調(diào)節(jié)的字串,a.span()返回字串的起始位置和末尾位置)

re.search(pattern,string,flags = 0)

作用:在string中從左往右搜索與pattern匹配的字串,無匹配結(jié)果則返回None,否則返回一個search實例。

str1 = 'ab cd'
result = re.search('cd',str1)
if result == None:
  print 'None'
else:
  print result.group(),result.start(),result.end()

結(jié)果:cd 3 5

re.match(pattern,string,flags = 0)

作用:判斷string的頭部是否與pattern匹配,是則返回match實例,否則返回None。

str1 = 'ab cd'
result = re.match('cd',str1)
if result == None:
  print 'None'
else:
  print result.group(),result.start(),result.end()

結(jié)果:None

re.compile(pattern,flags = 0)

作用:對匹配格式pattern進行編譯,返回一個實例對象。對正則表達式先編譯,可以大幅提高匹配速度。

str1 = 'ab cd'
pre = re.compile('ab')
print pre.findall(str1)

結(jié)果:['ab']

re.split(pattern,string,maxsplit = 0,flags = 0)

作用:在string匹配pattern的時候做分割:

str1 = 'ab.c.de'
str2 = '12+34-56*78/90'
print re.split('\.',str1)
print re.split('[\+\-\*/]',str2)

結(jié)果:

['ab', 'c', 'de']
      ['12', '34', '56', '78', '90']

re.sub(pattern,repl,string,count = 0,flags = 0)

作用:在string當(dāng)中把滿足pattern正則的字串替換成repl:

str1 = 'abcde'
print re.sub('bc','123',str1)

結(jié)果:a123de

re.subn(pattern,repl,string,count = 0,flags = 0)

作用:其功能與re.sub()相同,但返回的結(jié)果多了一個數(shù)字,代表替換了多少次

str1 = 'abcdebce'
print re.subn('bc','123',str1)

結(jié)果:('a123de123e', 2)

PS:這里再為大家提供2款非常方便的正則表達式工具供大家參考使用:

JavaScript正則表達式在線測試工具:
http://tools.jb51.net/regex/javascript

正則表達式在線生成工具:
http://tools.jb51.net/regex/create_reg

更多關(guān)于Python相關(guān)內(nèi)容可查看本站專題:《Python正則表達式用法總結(jié)》、《Python數(shù)據(jù)結(jié)構(gòu)與算法教程》、《Python Socket編程技巧總結(jié)》、《Python函數(shù)使用技巧總結(jié)》、《Python字符串操作技巧匯總》、《Python入門與進階經(jīng)典教程》及《Python文件與目錄操作技巧匯總

希望本文所述對大家Python程序設(shè)計有所幫助。

相關(guān)文章

  • Python數(shù)據(jù)結(jié)構(gòu)與算法中的隊列詳解(1)

    Python數(shù)據(jù)結(jié)構(gòu)與算法中的隊列詳解(1)

    這篇文章主要為大家詳細介紹了Python的隊列,文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們可以參考一下,希望能夠給你帶來幫助
    2022-03-03
  • python將類似json的數(shù)據(jù)存儲到MySQL中的實例

    python將類似json的數(shù)據(jù)存儲到MySQL中的實例

    今天小編就為大家分享一篇python將類似json的數(shù)據(jù)存儲到MySQL中的實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-07-07
  • Python如何獲取域名的SSL證書信息和到期時間

    Python如何獲取域名的SSL證書信息和到期時間

    在當(dāng)今互聯(lián)網(wǎng)時代,SSL證書的重要性不言而喻,它不僅為用戶提供了安全的連接,還能提高網(wǎng)站的搜索引擎排名,那我們怎么才能通過Python獲取域名的SSL證書信息和到期時間呢,下面小編就來簡單講講吧
    2025-03-03
  • Python3實時操作處理日志文件的實現(xiàn)

    Python3實時操作處理日志文件的實現(xiàn)

    本文主要介紹了Python3實時操作處理日志文件的實現(xiàn),文中通過示例代碼介紹的非常詳細,對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2023-03-03
  • 解決pandas報錯'DataFrame' object has no attribute 'as_matrix'問題

    解決pandas報錯'DataFrame' object has no

    這篇文章主要介紹了解決pandas報錯'DataFrame' object has no attribute 'as_matrix'問題,具有很好的參考價值,希望對大家有所幫助,如有錯誤或未考慮完全的地方,望不吝賜教
    2023-08-08
  • Python基礎(chǔ)教程之多線程編程詳解

    Python基礎(chǔ)教程之多線程編程詳解

    Python支持多線程編程和多進程編程,在本教程中,我們將學(xué)習(xí)有關(guān)Python多線程編程的基礎(chǔ)知識、線程同步、線程池以及如何使用多進程,需要的朋友可以參考下
    2023-06-06
  • python爬蟲獲取百度首頁內(nèi)容教學(xué)

    python爬蟲獲取百度首頁內(nèi)容教學(xué)

    在本篇內(nèi)容里小編給大家分享了關(guān)于python爬蟲獲取百度首頁內(nèi)容教學(xué),需要的朋友們可以跟著學(xué)習(xí)下。
    2018-12-12
  • Python實現(xiàn)處理逆波蘭表達式示例

    Python實現(xiàn)處理逆波蘭表達式示例

    這篇文章主要介紹了Python實現(xiàn)處理逆波蘭表達式操作,結(jié)合實例形式分析了逆波蘭表達式的概念、原理及Python針對逆波蘭表達式的定義與計算相關(guān)操作技巧,需要的朋友可以參考下
    2018-07-07
  • python3簡單實現(xiàn)微信爬蟲

    python3簡單實現(xiàn)微信爬蟲

    我們可以通過python 來實現(xiàn)這樣一個簡單的爬蟲功能,把我們想要的代碼爬取到本地。下面就看看如何使用python來實現(xiàn)這樣一個功能。
    2015-04-04
  • python Flask實現(xiàn)restful api service

    python Flask實現(xiàn)restful api service

    本篇文章主要介紹了python Flask實現(xiàn)restful api service,小編覺得挺不錯的,現(xiàn)在分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2017-12-12

最新評論

碌曲县| 永新县| 沁阳市| 青海省| 称多县| 慈溪市| 两当县| 会同县| 佳木斯市| 剑川县| 兰西县| 怀安县| 汪清县| 家居| 青铜峡市| 桐城市| 文登市| 永济市| 黔西| 同仁县| 尤溪县| 西贡区| 靖州| 武定县| 垦利县| 上蔡县| 贡觉县| 郧西县| 海晏县| 柏乡县| 峨山| 吉林市| 河南省| 威宁| 松潘县| 阿克| 盈江县| 翼城县| 肇东市| 安阳县| 宝清县|