最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python re.match()用法相關示例

 更新時間:2021年01月27日 10:38:55   作者:虛在君  
這篇文章主要介紹了python re.match()用法相關示例,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧

學習python爬蟲時遇到了一個問題,書上有示例如下:

import re

line='Cats are smarter than dogs'
matchObj=re.match(r'(.*)are(.*?).*',line)

if matchObj:
 print('matchObj.group():',matchObj.group())
 print('matchObj.group(1):', matchObj.group(1))
 print('matchObj.group(2):', matchObj.group(2))
else:
 print('No match!\n')

書上的期望輸出是:

matchObj.group(): Cats are smarter than dogs
matchObj.group(1): Cats
matchObj.group(2):smarter

但是我在電腦上跑了一遍得到的輸出卻是:

matchObj.group(): Cats are smarter than dogs
matchObj.group(1): Cats
matchObj.group(2):

于是開始想辦法徹底搞清楚這個差別的原因所在。

首先要讀懂這幾行代碼,而這一行代碼的關鍵在于這一句:

matchObj=re.match(r'(.*)are(.*?).*',line)

匹配的正則表達式是

(.*)are(.*?).*
前面的r表示的是匹配的字符不進行轉義,而要匹配的字符串是line,也就是
Cats are smarter than dogs
后面使用group(num),個人理解是,按照正則表達式中的括號數可以捕獲得到對應數量的捕獲組,而調用group(num)就可以得到對應捕獲組的內容,
其中group(0)表示的是匹配的整個表達式的字符串,在本例中就是‘Cats are smarter than dogs'。
參照網上可以搜到的符號的作用:
.匹配除換行符以外的任意字符
*重復之前的字符零次或更多次
?重復之前的字符零次或一次
那么第一個括號的內容,應當就是匹配要匹配的字符串中are之前的所有字符(除換行符),
而第二個括號的內容應當是匹配are之后的內容,但具體想指代什么卻顯得有些不明確。
不明確的點就在于*和?這兩個符號的連用,根據優(yōu)先級這兩個符號是同一優(yōu)先級的,那么應當按照順序生效,那么如此翻譯的話,這一語句匹配的就是長度為0到無限大的任意字符串,為了探清此時
程序判斷的具體內容,我們給匹配字符串末尾的.*也加上括號以提取其內容,而后在輸出部分加上對應語句:

import re

line='Cats are smarter than dogs'
matchObj=re.match(r'(.*)are(.*?)(.*)',line)

if matchObj:
 print("matchObj.group():",matchObj.group())
 print("matchObj.group(1):", matchObj.group(1))
 print("matchObj.group(2):", matchObj.group(2))
 print("matchObj.group(3):", matchObj.group(3))
else:
 print('No match!\n')

得到的結果是:

matchObj.group(): Cats are smarter than dogs
matchObj.group(1): Cats
matchObj.group(2):
matchObj.group(3):  smarter than dogs

可見第二個括號里的內容被默認為空了,然后刪去那個?,可以看到結果變成:

matchObj.group(): Cats are smarter than dogs
matchObj.group(1): Cats
matchObj.group(2):  smarter than dogs
matchObj.group(3):

那么這是否就意味著?的默認值很可能是0次,那?這個符號到底有什么用呢

仔細想來這個說法并不是很嚴謹。嘗試使用單獨的.?組合可以看到這個組合可以用于提取

單個不知道是否存在的字符,而如下代碼

import re

line='Cats are smarter than dogs'
matchObj=re.match(r'(.*) are(.*)?',line)

if matchObj:
 print("matchObj.group():",matchObj.group())
 print("matchObj.group(1):", matchObj.group(1))
 print("matchObj.group(2):", matchObj.group(2))

也能在組別2中正常提取到are之后的字符內容,但稍微改動一下將?放到第二個括號內,

就什么也提取不到,同時導致group(0)中匹配的字符到Cats are就截止了(也就是第二個括號匹配失敗)。

令人感到奇怪的是,如果將上面的代碼改成

import re

line='Cats are smarter than dogs'
matchObj=re.match(r'(.*) are (.*)+',line)

if matchObj:
 print("matchObj.group():",matchObj.group())
 print("matchObj.group(1):", matchObj.group(1))
 print("matchObj.group(2):", matchObj.group(2))

也就是僅僅將?改為+,雖然能成功匹配整個line但group(2)中沒有內容,

如果把+放到第二個括號中就會產生報錯,匹配失敗。

那么是否可以認為.*?這三個符號連用只是一個不規(guī)范的操作,但由于?的特殊性所以沒有報錯反而匹配成功了呢?

具體的可能要研究代碼本身的機理了,暫且擱置。還有一個問題就是如何達到樣例本身想要的,用第二個括號提取單個單詞的目的。

如果單單考慮這個例子的話,把原本第二個括號中的?換成r就可以了,也就是如下代碼:

import re

line='Cats are smarter than dogs'
matchObj=re.match(r'(.*) are (.*r).*',line)

if matchObj:
 print("matchObj.group():",matchObj.group())
 print("matchObj.group(1):", matchObj.group(1))
 print("matchObj.group(2):", matchObj.group(2))
 #print("matchObj.group(3):", matchObj.group(3))
else:
 print('No match!\n')

為了泛用性嘗試了一下把r改成‘ '但是得到的結果是‘smarter than '。于是嘗試把.換成表示任意字母的

[a-zA-Z],成功提取出了單個smarter,代碼如下:

import re

line='Cats are smarter than dogs'
matchObj=re.match(r'(.*) are ([a-zA-Z]* ).*',line)

if matchObj:
 print("matchObj.group():",matchObj.group())
 print("matchObj.group(1):", matchObj.group(1))
 print("matchObj.group(2):", matchObj.group(2))
 #print("matchObj.group(3):", matchObj.group(3))
else:
 print('No match!\n')

到此這篇關于python re.match()用法相關示例的文章就介紹到這了,更多相關python re.match()內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • Python單元測試unittest模塊使用終極指南

    Python單元測試unittest模塊使用終極指南

    本文將詳細介紹unittest模塊的各個方面,包括測試用例、斷言、測試套件、setUp和tearDown方法、跳過和期望異常、測試覆蓋率、持續(xù)集成等內容,我們將提供豐富的示例代碼,以便讀者更好地理解如何使用unittest進行單元測試
    2023-12-12
  • Python?Pyecharts繪制象形柱圖

    Python?Pyecharts繪制象形柱圖

    echarts是百度開源的一個數據可視化JS庫,主要用于數據可視化。pyecharts是一個用于生成Echarts圖表的類庫。實際上就是Echarts與Python的對接。本文將利用pyecharts庫繪制象形柱狀圖,感興趣的可以了解一下
    2022-01-01
  • pandas根據指定條件篩選數據的實現示例

    pandas根據指定條件篩選數據的實現示例

    條件篩選是pandas中非常重要的一個功能,它允許我們根據特定條件來快速、高效地篩選數據,本文主要介紹了pandas根據指定條件篩選數據的實現示例,具有一定的參考價值,感興趣的可以了解一下
    2024-03-03
  • 利用python繪制二三維曲面和矢量流線圖的代碼示例

    利用python繪制二三維曲面和矢量流線圖的代碼示例

    這篇文章主要給大家詳細介紹了如何利用python繪制二三維曲面和矢量流線圖,文中通過代碼示例介紹的非常詳細,對我們學習或工作有一定的幫助,需要的朋友可以參考下
    2023-07-07
  • Python 如何調試程序崩潰錯誤

    Python 如何調試程序崩潰錯誤

    這篇文章主要介紹了Python 如何調試程序崩潰錯誤,文中講解非常細致,代碼幫助大家更好的理解和學習,感興趣的朋友可以了解下
    2020-08-08
  • Python列表list的詳細用法介紹

    Python列表list的詳細用法介紹

    這篇文章主要介紹了Python列表list的詳細用法介紹,列表(list)作為Python中基本的數據結構,是存儲數據的容器,相當于其它語言中所說的數組
    2022-07-07
  • 用Python進行websocket接口測試

    用Python進行websocket接口測試

    這篇文章主要介紹了用Python進行websocket接口測試,幫助大家更好的理解和使用python,感興趣的朋友可以了解下
    2020-10-10
  • PyTorch實現更新部分網絡,其他不更新

    PyTorch實現更新部分網絡,其他不更新

    今天小編就為大家分享一篇PyTorch實現更新部分網絡,其他不更新,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-12-12
  • 合并百度影音的離線數據( with python 2.3)

    合并百度影音的離線數據( with python 2.3)

    這篇文章主要介紹了合并百度影音的離線數據( with python 2.3)的相關資料
    2015-08-08
  • 在FastAPI中改變響應狀態(tài)碼的兩種方法

    在FastAPI中改變響應狀態(tài)碼的兩種方法

    FastAPI,顧名思義,是一個快速、現代、高性能的web框架,用于用Python構建后端api,響應狀態(tài)碼是一個三位數,表示請求的結果,在這篇簡明的基于示例的博文中,我將向你展示在FastAPI中更改響應狀態(tài)代碼的兩種不同方法,需要的朋友可以參考下
    2025-02-02

最新評論

遂平县| 襄汾县| 光山县| 洪江市| 顺昌县| 奎屯市| 德钦县| 建湖县| 台山市| 兴安盟| 丰县| 利川市| 涿州市| 开远市| 屏东市| 中超| 西青区| 沈阳市| 隆尧县| 淮南市| 奉化市| 清水河县| 宜良县| 徐闻县| 焦作市| 大石桥市| 象山县| 同德县| 松滋市| 北票市| 涞水县| 沈丘县| 乐都县| 安乡县| 伊金霍洛旗| 三亚市| 永康市| 峡江县| 金沙县| 肥东县| 广汉市|