最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

正則表達(dá)式之文本模式的匹配和查找

 更新時(shí)間:2019年08月23日 15:42:53   作者:IT派森  
這篇文章主要介紹了正則表達(dá)式之文本模式的匹配和查找操作方法,本文給大家介紹的非常詳細(xì),具有一定的參考借鑒價(jià)值,需要的朋友可以參考下

1、需求

我們想要按照特定的文本模式進(jìn)行匹配或查找。

2、解決方案

如果想要匹配的只是簡(jiǎn)單的文字,那么通常只需要用基本的字符串方法就可以了,比如str.find()、str.endswith()、str.startswith()或類(lèi)似函數(shù)。

示例:

text='mark ,帥哥,18,183 帥,mark'
print(text=='mark')
print(text.startswith('mark'))
print(text.startswith('mark'))
print(text.find('帥哥'))

結(jié)果:

False
True
True
6

如果更為復(fù)雜的匹配則需要使用正則表達(dá)式以及re模塊。為了說(shuō)明使用正則表達(dá)式的基本流程,假設(shè)我們想匹配以數(shù)字形式構(gòu)成的日期,比如"11/27/2018"。示例如下:

import re
text1='11/27/2018'
text2='Nov 27, 2018'
if re.match(r'\d+/\d+/\d+',text1):
  print('符合模型:數(shù)字/數(shù)字/數(shù)字')
else:
  print('不符合模型:數(shù)字/數(shù)字/數(shù)字')

if re.match(r'\d+/\d+/\d+',text2):
  print('符合模型:數(shù)字/數(shù)字/數(shù)字')
else:
  print('不符合模型:數(shù)字/數(shù)字/數(shù)字')

運(yùn)行結(jié)果:

符合模型:數(shù)字/數(shù)字/數(shù)字
不符合模型:數(shù)字/數(shù)字/數(shù)字

如果打算針對(duì)同一模型做多次匹配,那么通常會(huì)先將正則表達(dá)式模式預(yù)編譯成一個(gè)模式對(duì)象。

例如:

import re
text1='11/27/2018'
text2='Nov 27, 2018'
datepat=re.compile(r'\d+/\d+/\d+')
if datepat.match(text1):
  print('符合模型:數(shù)字/數(shù)字/數(shù)字')
else:
  print('不符合模型:數(shù)字/數(shù)字/數(shù)字')

if datepat.match(text2):
  print('符合模型:數(shù)字/數(shù)字/數(shù)字')
else:
  print('不符合模型:數(shù)字/數(shù)字/數(shù)字')

結(jié)果:

符合模型:數(shù)字/數(shù)字/數(shù)字
不符合模型:數(shù)字/數(shù)字/數(shù)字

match()方法總是嘗試在字符串的開(kāi)頭找到匹配項(xiàng)。如果想針對(duì)整個(gè)文本搜索出所有的匹配項(xiàng),那么就應(yīng)該使用findall()方法,例如:

import re
text='今天是 11/27/2018,昨天是11/26/2018'
datepat=re.compile(r'\d+/\d+/\d+')
print(datepat.findall(text))

運(yùn)行結(jié)果:

['11/27/2018', '11/26/2018']

當(dāng)定義正則表達(dá)式時(shí),我們常會(huì)將部分模式用括號(hào)包起來(lái)的方式引入捕獲組,捕獲組通常簡(jiǎn)化后續(xù)對(duì)匹配文本的處理,因?yàn)槊總€(gè)組的內(nèi)容都可以單獨(dú)提取出來(lái)。findall()方法搜索整個(gè)文本并找出所有的匹配項(xiàng)然后將它們以列表的形式返回。如果想以迭代的方式找出匹配項(xiàng),可以使用finditer()方法。

例如:

import re
#加入捕獲組
datepat=re.compile(r'(\d+)+/(\d+)+/(\d+)')
m=datepat.match('11/27/2018')
print(m.group(0))
print(m.group(1))
print(m.group(2))
print(m.group(3))
print(m.groups())
month,day,year=m.groups()
print(month)
print(day)
print(year)

print('*'*20)

text='今天是 11/27/2018,昨天是11/26/2018'
for month,day,year in datepat.findall(text):
  print('{}-{}-{}'.format(year,month,day))

print('*'*20)

for m in datepat.finditer(text):
  print(m.groups())

結(jié)果:

11/27/2018
11
27
2018
('11', '27', '2018')
11
27
2018
********************
2018-11-27
2018-11-26
********************
('11', '27', '2018')
('11', '26', '2018')

3、分析

本節(jié)主要介紹了re模塊對(duì)文本匹配和搜索的基本功能,首先用re.compile()對(duì)模式進(jìn)行編譯,然后使用想match()、findall()、finditer()這樣的方法做匹配和搜索。

當(dāng)指定模式時(shí)我們通常會(huì)使用原始字符串,例如:

r'(\d+)/(\d+)/(\d+)'

這樣的字符串不會(huì)對(duì)反斜字符轉(zhuǎn)義,這在正則表達(dá)式中非常有用。否則,我們需要用雙反斜杠線來(lái)標(biāo)識(shí)一個(gè)單獨(dú)的'',例如:

'(\\d+)/(\\d+)/(\\d+)'

請(qǐng)注意match()方法只會(huì)檢查字符的開(kāi)頭,有可能出現(xiàn)的匹配的結(jié)果并不是你想要的,例如:

import re
#加入捕獲組
datepat=re.compile(r'(\d+)+/(\d+)+/(\d+)')
m=datepat.match('11/27/2018xxxx')
print(m)

結(jié)果:

<re.Match object; span=(0, 10), match='11/27/2018'>

如果想要精確匹配,可以加一個(gè)結(jié)束標(biāo)記:$

import re
#加入捕獲組
datepat=re.compile(r'(\d+)+/(\d+)+/(\d+)$')
m1=datepat.match('11/27/2018xxxx')
m2=datepat.match('11/27/2018')
print(m1)
print(m2)

結(jié)果:

None
<re.Match object; span=(0, 10), match='11/27/2018'>

如果只是執(zhí)行簡(jiǎn)單的文本匹配和搜索操作,可以省略編譯步驟。
如果打算執(zhí)行很多匹配或查找操作的話,通常需要先將模式編譯然后重復(fù)使用。模塊級(jí)的函數(shù)會(huì)對(duì)最近編譯過(guò)的模式做緩存處理,并且比較省步驟。

總結(jié)

以上所述是小編給大家介紹的正則表達(dá)式之文本模式的匹配和查找,希望對(duì)大家有所幫助,如果大家有任何疑問(wèn)請(qǐng)給我留言,小編會(huì)及時(shí)回復(fù)大家的。在此也非常感謝大家對(duì)腳本之家網(wǎng)站的支持!
如果你覺(jué)得本文對(duì)你有幫助,歡迎轉(zhuǎn)載,煩請(qǐng)注明出處,謝謝!

相關(guān)文章

  • PHP正則表達(dá)式基礎(chǔ)入門(mén)

    PHP正則表達(dá)式基礎(chǔ)入門(mén)

    這篇是一篇關(guān)于PHP正則表達(dá)式基礎(chǔ)入門(mén)的文章,教大家如何學(xué)習(xí)php正則表達(dá)式,從而真正的掌握php正則表達(dá)式,感興趣的小伙伴們可以參考一下
    2015-11-11
  • PHP正則表達(dá)式的效率 回溯與固化分組

    PHP正則表達(dá)式的效率 回溯與固化分組

    上文中,我們聊到了一點(diǎn)關(guān)于PHP中(NFA PCRE)正則表達(dá)式匹配優(yōu)先量詞,忽略優(yōu)先量詞的匹配原理了。那么上文留下的問(wèn)題,您的答案是什么呢?
    2011-04-04
  • 基于xpath選擇器、PyQuery、正則表達(dá)式的格式清理工具詳解

    基于xpath選擇器、PyQuery、正則表達(dá)式的格式清理工具詳解

    這篇文章主要介紹了基于xpath選擇器、PyQuery、正則表達(dá)式的格式清理工具,本文給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2020-09-09
  • js正則解析URL參數(shù)示例代碼

    js正則解析URL參數(shù)示例代碼

    URL參數(shù)使用js正則解析具體實(shí)現(xiàn)代碼如下,有需求的朋友可以參考下,希望對(duì)大家有所幫組
    2013-08-08
  • asp匹配網(wǎng)址的正則

    asp匹配網(wǎng)址的正則

    這篇文章主要介紹了asp匹配網(wǎng)址的正則,需要的朋友可以參考下
    2007-09-09
  • [js]一個(gè)只刪除所有font標(biāo)簽的正則函數(shù)

    [js]一個(gè)只刪除所有font標(biāo)簽的正則函數(shù)

    [js]一個(gè)只刪除所有font標(biāo)簽的正則函數(shù)...
    2007-09-09
  • 編寫(xiě)高質(zhì)量的js之正確理解正則表達(dá)式回溯

    編寫(xiě)高質(zhì)量的js之正確理解正則表達(dá)式回溯

    在正則表達(dá)式實(shí)現(xiàn)中,回溯是匹配過(guò)程的基本組成部分,它是正則表達(dá)式如此好用和強(qiáng)大的根源。然而,回溯計(jì)算代價(jià)很高,如果設(shè)計(jì)失誤,將導(dǎo)致失控。回溯是影響整體性能的唯一因素,理解它的工作原理,以及如何減小使用頻率,可能是編寫(xiě)高效正則表達(dá)式的關(guān)鍵點(diǎn)
    2016-12-12
  • 正則表達(dá)式詳解(正則基礎(chǔ)入門(mén)教程)

    正則表達(dá)式詳解(正則基礎(chǔ)入門(mén)教程)

    正則表達(dá)式是一組由字母和符號(hào)組成的特殊文本,它可以用來(lái)從文本中找出滿足你想要的格式的句子,通俗的講就是按照某種規(guī)則去匹配符合條件的字符串
    2023-12-12
  • ES2015 正則表達(dá)式新增特性

    ES2015 正則表達(dá)式新增特性

    ES2015 正則表達(dá)式新增特性,在原來(lái)正則表達(dá)式基礎(chǔ)上,ES2015增強(qiáng)了對(duì)四字節(jié)unicode字符的支持等功能
    2016-12-12
  • js正則表達(dá)式常用函數(shù)詳解(續(xù))

    js正則表達(dá)式常用函數(shù)詳解(續(xù))

    之前一篇已經(jīng)帶領(lǐng)大家認(rèn)識(shí)了一下正則表達(dá)式常用函數(shù)最基本的功能及使用方法。本文再帶領(lǐng)大家一起應(yīng)用正則表達(dá)式,深入學(xué)習(xí)正則表達(dá)式中常用的方法及對(duì)象,例如:test、exec、match、replace、search等等,需要的朋友可以參考下
    2015-12-12

最新評(píng)論

甘孜县| 繁峙县| 丹巴县| 甘泉县| 钟祥市| 阿拉善右旗| 新泰市| 都匀市| 大冶市| 三穗县| 云和县| 黑龙江省| 太原市| 正蓝旗| 大名县| 濉溪县| 咸宁市| 疏勒县| 泽普县| 苏尼特左旗| 龙陵县| 南漳县| 青铜峡市| 石城县| 新平| 临武县| 垦利县| 银川市| 沅陵县| 中牟县| 永州市| 合肥市| 新河县| 堆龙德庆县| 乐东| 长治县| 台湾省| 德江县| 巩义市| 四子王旗| 西藏|