最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python實(shí)現(xiàn)提取給定網(wǎng)頁內(nèi)的所有鏈接

 更新時(shí)間:2023年05月18日 10:42:53   作者:海擁  
這篇文章主要和大家分享一個(gè)實(shí)用的Python腳本,可以實(shí)現(xiàn)從給定的網(wǎng)頁中檢索所有鏈接,并將其保存為txt文件,需要的小伙伴可以收藏一下

此腳本從給定的網(wǎng)頁中檢索所有鏈接,并將其保存為txt文件。(文末有完整源碼)

這是一個(gè)簡(jiǎn)單的網(wǎng)絡(luò)爬蟲示例,使用了 requests 庫(kù)來發(fā)送 HTTP 請(qǐng)求并獲取網(wǎng)頁內(nèi)容,使用 BeautifulSoup 庫(kù)來解析網(wǎng)頁內(nèi)容。

代碼解釋如下:

1.導(dǎo)入所需的庫(kù)

導(dǎo)入 requests 庫(kù)并將其重命名為 rq,用于發(fā)送 HTTP 請(qǐng)求和獲取網(wǎng)頁內(nèi)容。

import requests as rq

從 bs4 庫(kù)導(dǎo)入 BeautifulSoup 類,用于解析 HTML 內(nèi)容。

from bs4 import BeautifulSoup

2.獲取用戶輸入的鏈接

提示用戶輸入一個(gè)鏈接,并將其保存在 url 變量中。

url = input("Enter Link: ")

3.發(fā)送 HTTP 請(qǐng)求獲取網(wǎng)頁內(nèi)容

  • 使用條件語句判斷用戶輸入的鏈接是否以 "https" 或 "http" 開頭。
  • 如果是,則使用 rq.get(url) 發(fā)送 GET 請(qǐng)求獲取網(wǎng)頁內(nèi)容,并將響應(yīng)保存在 data 變量中。
  • 如果不是,則在鏈接前添加 "https://" 并使用 rq.get() 發(fā)送請(qǐng)求,將響應(yīng)保存在 data 變量中。

4.使用 BeautifulSoup 解析網(wǎng)頁內(nèi)容

將 data.text(網(wǎng)頁內(nèi)容)傳遞給 BeautifulSoup 類的構(gòu)造函數(shù),指定解析器為 "html.parser",創(chuàng)建一個(gè) BeautifulSoup 對(duì)象 soup。

soup = BeautifulSoup(data.text, "html.parser")

5.提取鏈接

  • 創(chuàng)建一個(gè)空列表 links 用于存儲(chǔ)提取的鏈接。
  • 使用 soup.find_all("a") 查找網(wǎng)頁中所有的 <a> 標(biāo)簽,并返回一個(gè)包含這些標(biāo)簽的列表。
  • 遍歷列表中的每個(gè)標(biāo)簽,使用 link.get("href") 獲取每個(gè)標(biāo)簽中的 "href" 屬性值,并將其添加到 links 列表中。

6.將提取的鏈接寫入文件

  • 使用 with open("myLinks.txt", 'a') as saved: 打開一個(gè)文件 "myLinks.txt",以追加模式。
  • 使用 print(links[:100], file=saved) 將 links 列表中的前 100 個(gè)鏈接寫入文件中,每個(gè)鏈接占一行。
  • 如果需要每次覆蓋文件內(nèi)容而不是追加,可以將文件打開模式由 'a' 改為 'w'。

這段代碼的功能是獲取用戶輸入的鏈接對(duì)應(yīng)網(wǎng)頁中的前 100 個(gè)鏈接,并將這些鏈接寫入到名為 "myLinks.txt" 的文件中。

運(yùn)行截圖

附完整代碼

import requests as rq
from bs4 import BeautifulSoup

url = input("Enter Link: ")
if ("https" or "http") in url:
    data = rq.get(url)
else:
    data = rq.get("https://" + url)
soup = BeautifulSoup(data.text, "html.parser")
links = []
for link in soup.find_all("a"):
    links.append(link.get("href"))

# 將輸出寫入文件(myLinks.txt)
# 可以將“a”更改為“w”以每次覆蓋文件
with open("myLinks.txt", 'a') as saved:
    print(links[:10], file=saved)

到此這篇關(guān)于Python實(shí)現(xiàn)提取給定網(wǎng)頁內(nèi)的所有鏈接的文章就介紹到這了,更多相關(guān)Python提取網(wǎng)頁鏈接內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • 解決python3中的requests解析中文頁面出現(xiàn)亂碼問題

    解決python3中的requests解析中文頁面出現(xiàn)亂碼問題

    requests是一個(gè)很實(shí)用的Python HTTP客戶端庫(kù),編寫爬蟲和測(cè)試服務(wù)器響應(yīng)數(shù)據(jù)時(shí)經(jīng)常會(huì)用到。這篇文章給大家介紹了解決python3中的requests解析中文頁面出現(xiàn)亂碼問題,感興趣的朋友一起看看吧
    2019-04-04
  • PySide2出現(xiàn)“ImportError: DLL load failed: 找不到指定的模塊”的問題及解決方法

    PySide2出現(xiàn)“ImportError: DLL load failed: 找不到指定的模塊”的問題及解決方法

    這篇文章主要介紹了PySide2出現(xiàn)“ImportError: DLL load failed: 找不到指定的模塊”的問題及解決方法,本文通過實(shí)例代碼給大家介紹的非常詳細(xì),需要的朋友可以參考下
    2020-06-06
  • python自定義解析簡(jiǎn)單xml格式文件的方法

    python自定義解析簡(jiǎn)單xml格式文件的方法

    這篇文章主要介紹了python自定義解析簡(jiǎn)單xml格式文件的方法,涉及Python解析XML文件的相關(guān)技巧,非常具有實(shí)用價(jià)值,需要的朋友可以參考下
    2015-05-05
  • python寫入Excel表格的方法詳解

    python寫入Excel表格的方法詳解

    這篇文章主要為大家詳細(xì)介紹了python寫入Excel表格的方法,使用jupyter?notebook,文中示例代碼介紹的非常詳細(xì),具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下
    2022-02-02
  • Python可視化學(xué)習(xí)之seaborn繪制線型回歸曲線

    Python可視化學(xué)習(xí)之seaborn繪制線型回歸曲線

    這篇文章主要為大家介紹了如何利用seaborn繪制變量之間線型回歸(linear regression)曲線,2文中涉及如下兩個(gè)重要函數(shù):seaborn.regplot和seaborn.lmplot,感興趣的小伙伴可以跟隨小編一起學(xué)習(xí)一下
    2022-02-02
  • 利用Python優(yōu)化數(shù)據(jù)庫(kù)N+1查詢問題的方法詳解

    利用Python優(yōu)化數(shù)據(jù)庫(kù)N+1查詢問題的方法詳解

    N+1查詢問題是一種常見的性能瓶頸,主要表現(xiàn)是應(yīng)用中需要執(zhí)行大量查詢,通常這是由于數(shù)據(jù)訪問模式中的代碼結(jié)構(gòu)不佳導(dǎo)致的,本文將使用Python進(jìn)行這一問題的優(yōu)化,需要的小伙伴可以了解下
    2025-09-09
  • 用python打印菱形的實(shí)操方法和代碼

    用python打印菱形的實(shí)操方法和代碼

    在本篇文章里小編給大家分享了關(guān)于用python打印菱形的實(shí)操方法和代碼,對(duì)此有需要的朋友們可以學(xué)習(xí)下。
    2019-06-06
  • Python 詞典(Dict) 加載與保存示例

    Python 詞典(Dict) 加載與保存示例

    今天小編就為大家分享一篇Python 詞典(Dict) 加載與保存示例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧
    2019-12-12
  • python模塊和包的應(yīng)用BASE_PATH使用解析

    python模塊和包的應(yīng)用BASE_PATH使用解析

    這篇文章主要介紹了python模塊和包的應(yīng)用BASE_PATH使用解析,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2019-12-12
  • 詳解Python中的日志模塊logging

    詳解Python中的日志模塊logging

    這篇文章主要介紹了Python中的日志模塊logging,包括Python下的日志級(jí)別以及模塊內(nèi)常用方法的使用,需要的朋友可以參考下
    2015-06-06

最新評(píng)論

沾益县| 蕉岭县| 景德镇市| 平原县| 中阳县| 青岛市| 卢氏县| 宜州市| 威远县| 高陵县| 会东县| 淳化县| 遵义市| 宝鸡市| 汨罗市| 林州市| 抚松县| 满洲里市| 读书| 嘉义市| 同心县| 荔波县| 张家界市| 上虞市| 万荣县| 陇西县| 黎川县| 额尔古纳市| 井研县| 平湖市| 民丰县| 若尔盖县| 霍林郭勒市| 华宁县| 乌海市| 卢氏县| 香格里拉县| 揭西县| 漳州市| 沧源| 东台市|