最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python爬蟲基本庫request的基本使用

 更新時(shí)間:2023年07月07日 10:18:32   作者:milk-request  
這篇文章主要介紹了Python爬蟲基本庫request的基本使用,urllib庫使用繁瑣,比如處理網(wǎng)頁驗(yàn)證和Cookies時(shí),需要編寫Opener和Handler來處理。為了更加方便的實(shí)現(xiàn)這些操作,就有了更為強(qiáng)大的requests庫,需要的朋友可以參考下

request

用urllib去處理網(wǎng)頁驗(yàn)證和Cookies時(shí),需要寫Opener和Handler來處理,很不方便,這里我們學(xué)習(xí)更為強(qiáng)大的庫request

get()

實(shí)例:

import requests #導(dǎo)入requests
html = requests.get('https://www.csdn.net/')#使用get方法獲取頁面信息
print(html.text)#調(diào)取text屬性查看頁面代碼

添加參數(shù)使用param+字典

import requests  # 導(dǎo)入requests
data = {
    'jl': '765',
    'kw': 'python',
    'kt': '3'
}
html = requests.get('https://sou.zhaopin.com/',params=data)  # 添加參數(shù)
print(html.text)  # 調(diào)取text屬性查看頁面代碼

添加headers使用headers+字典

import requests  # 導(dǎo)入requests
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/80.0.3987.149 Safari/537.36'
}
data = {
    'jl': '765',
    'kw': 'python',
    'kt': '3'
}
html = requests.get('https://sou.zhaopin.com/',headers=headers,params=data)  # 添加參數(shù)
print(html.text)  # 調(diào)取text屬性查看頁面代碼

高級(jí)用法

cookies設(shè)置,代理設(shè)置等

Cookies

獲取cookies:

import requests  # 導(dǎo)入requests
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/80.0.3987.149 Safari/537.36'
}
data = {
    'jl': '765',
    'kw': 'python',
    'kt': '3'
}
html = requests.get('https://blog.csdn.net/qq_40966461/article/details/104974998',headers=headers,params=data)  # 添加參數(shù)
print(html.cookies)  # 調(diào)取text屬性查看頁面代碼
for key,value in html.cookies.items():
    print(key+'='+value)

很簡單,直接獲取cookies屬性即可

維持會(huì)話Session()

在requests中,如果直接利用get()或post()等方法可以做到模擬網(wǎng)頁的請求,但是這實(shí)際上時(shí)相當(dāng)于不同的會(huì)話,相當(dāng)于用了兩個(gè)瀏覽器打開了不同的頁面,這時(shí)需要用session對象來維護(hù)對話

import requests  # 導(dǎo)入requests
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/80.0.3987.149 Safari/537.36'
}
data = {
    'jl': '765',
    'kw': 'python',
    'kt': '3'
}
html = requests.Session().get('https://blog.csdn.net/qq_40966461/article/details/104974998',headers=headers,params=data)  # 添加參數(shù)
print(html.cookies)  # 調(diào)取text屬性查看頁面代碼
for key,value in html.cookies.items():
    print(key+'='+value)

調(diào)用requests模塊中g(shù)et方法時(shí)先創(chuàng)建一個(gè)Session對象

SSL證書驗(yàn)證

import requests  # 導(dǎo)入requests
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/80.0.3987.149 Safari/537.36'
}
response  = requests.get('http://www.12306.cn',headers=headers,verify = False)
print(response.status_code)

verify=False即可

代理設(shè)置

import requests  # 導(dǎo)入requests
headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/80.0.3987.149 Safari/537.36'
}
proxies = {
    "http":"http://183.166.132.176",
    "https":"https://183.166.132.176"
}
response  = requests.get('http://www.12306.cn',headers=headers,proxies=proxies,verify = False)
print(response.status_code)

添加proxies即可,代理可以搜索快代理

超時(shí)設(shè)置

加參數(shù)timeout= 1

身份認(rèn)證

get中添加參數(shù) auth=(‘username’,‘password’)

OAuth認(rèn)證方式

到此這篇關(guān)于Python爬蟲基本庫request的基本使用的文章就介紹到這了,更多相關(guān)Python爬蟲request庫內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • python使用pywinauto驅(qū)動(dòng)微信客戶端實(shí)現(xiàn)公眾號(hào)爬蟲

    python使用pywinauto驅(qū)動(dòng)微信客戶端實(shí)現(xiàn)公眾號(hào)爬蟲

    這個(gè)項(xiàng)目是通過pywinauto控制windows(win10)上的微信PC客戶端來實(shí)現(xiàn)公眾號(hào)文章的抓取。代碼分成server和client兩部分。server接收client抓取的微信公眾號(hào)文章,并且保存到數(shù)據(jù)庫。另外server支持簡單的搜索和導(dǎo)出功能。client通過pywinauto實(shí)現(xiàn)微信公眾號(hào)文章的抓取。
    2021-05-05
  • 使用Python請求http/https時(shí)如何設(shè)置失敗重試次數(shù)

    使用Python請求http/https時(shí)如何設(shè)置失敗重試次數(shù)

    這篇文章主要介紹了使用Python請求http/https時(shí)如何設(shè)置失敗重試次數(shù)問題,具有很好的參考價(jià)值,希望對大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2024-06-06
  • Python實(shí)現(xiàn)決策樹C4.5算法的示例

    Python實(shí)現(xiàn)決策樹C4.5算法的示例

    本篇文章主要介紹了Python實(shí)現(xiàn)決策樹C4.5算法的示例,詳解的介紹了決策樹C4.5算法的原理和實(shí)現(xiàn)代碼,非常具有實(shí)用價(jià)值,需要的朋友可以參考下
    2018-05-05
  • Python全面解析xml文件

    Python全面解析xml文件

    這篇文章主要介紹了Python全面解析xml文件方式,具有很好的參考價(jià)值,希望對大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2024-02-02
  • Python 類與元類的深度挖掘 II【經(jīng)驗(yàn)】

    Python 類與元類的深度挖掘 II【經(jīng)驗(yàn)】

    元類在 Python 中屬于比較深層的黑魔法,在一般的日常應(yīng)用中可能并不常用,但理解其背后的原理對于理解 Python 面向?qū)ο缶幊桃约耙磺薪詾閷ο蟮睦砟詈苡袔椭?;如果你需要對類進(jìn)行深度改造,至少要知道從何入手。
    2016-05-05
  • numpy數(shù)組切片的使用

    numpy數(shù)組切片的使用

    本文主要介紹了numpy數(shù)組切片的使用,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧
    2023-02-02
  • numpy按列連接兩個(gè)維數(shù)不同的數(shù)組方式

    numpy按列連接兩個(gè)維數(shù)不同的數(shù)組方式

    今天小編就為大家分享一篇numpy按列連接兩個(gè)維數(shù)不同的數(shù)組方式,具有很好的參考價(jià)值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-12-12
  • python輸入、數(shù)據(jù)類型轉(zhuǎn)換及運(yùn)算符方式

    python輸入、數(shù)據(jù)類型轉(zhuǎn)換及運(yùn)算符方式

    這篇文章主要介紹了python輸入、數(shù)據(jù)類型轉(zhuǎn)換及運(yùn)算符方式,具有很好的參考價(jià)值,希望對大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2022-07-07
  • python中圖片文件路徑格式如何使用

    python中圖片文件路徑格式如何使用

    這篇文章主要介紹了python中圖片文件路徑格式如何使用問題,具有很好的參考價(jià)值,希望對大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2023-08-08
  • 一文詳解如何使用Python實(shí)時(shí)輸出鼠標(biāo)坐標(biāo)

    一文詳解如何使用Python實(shí)時(shí)輸出鼠標(biāo)坐標(biāo)

    本文詳細(xì)介紹了如何使用Python中的pynput庫來實(shí)時(shí)獲取并輸出鼠標(biāo)的坐標(biāo)信息,通過pynput庫,可以輕松實(shí)現(xiàn)對鼠標(biāo)坐標(biāo)的跟蹤,適用于需要鼠標(biāo)交互的應(yīng)用場景,文中通過代碼介紹的非常詳細(xì),需要的朋友可以參考下
    2024-10-10

最新評(píng)論

论坛| 永平县| 唐海县| 凌海市| 平乐县| 巴彦淖尔市| 米林县| 彭水| 分宜县| 毕节市| 邢台县| 塔河县| 平远县| 拉萨市| 吉林市| 平和县| 石阡县| 三亚市| 五原县| 河间市| 藁城市| 浑源县| 玉屏| 乌拉特中旗| 延安市| 姚安县| 华池县| 永寿县| 边坝县| 醴陵市| 郎溪县| 永春县| 抚宁县| 修文县| 汝阳县| 怀宁县| 三都| 绥宁县| 平乡县| 米易县| 密山市|