Python獲取網(wǎng)頁上圖片下載地址的方法
更新時間:2015年03月11日 09:32:14 作者:saintatgod
這篇文章主要介紹了Python獲取網(wǎng)頁上圖片下載地址的方法,涉及Python操作正則表達式匹配字符串的技巧,需要的朋友可以參考下
本文實例講述了Python獲取網(wǎng)頁上圖片下載地址的方法。分享給大家供大家參考。具體如下:
這里獲取網(wǎng)頁上圖片的下載地址是正在寫的數(shù)據(jù)采集中的一段,代碼如下:
復(fù)制代碼 代碼如下:
#!/user/bin/python3
import urllib2
from HTMLParser import HTMLParser
class MyHtmlParser(HTMLParser):
links = []
def handle_starttag(self, tag, attrs):
if tag == "img":
if len(attrs) == 0:
pass
else:
for name, value in attrs:
if name == "src":
self.links.append(value)
if __name__ == "__main__":
uri = "http://dy.163.com/v2/article/T1374483113516/AGSNE9L000964K4O"
file = urllib2.urlopen(uri).read()
# file = "<html><h1>Title</h1><p>I'm a paragraph!</p></html>"
hy = MyHtmlParser()
hy.feed(file)
hy.close()
print(hy.links)
import urllib2
from HTMLParser import HTMLParser
class MyHtmlParser(HTMLParser):
links = []
def handle_starttag(self, tag, attrs):
if tag == "img":
if len(attrs) == 0:
pass
else:
for name, value in attrs:
if name == "src":
self.links.append(value)
if __name__ == "__main__":
uri = "http://dy.163.com/v2/article/T1374483113516/AGSNE9L000964K4O"
file = urllib2.urlopen(uri).read()
# file = "<html><h1>Title</h1><p>I'm a paragraph!</p></html>"
hy = MyHtmlParser()
hy.feed(file)
hy.close()
print(hy.links)
希望本文所述對大家的Python程序設(shè)計有所幫助。
相關(guān)文章
python 對dataframe下面的值進行大規(guī)模賦值方法
今天小編就為大家分享一篇python 對dataframe下面的值進行大規(guī)模賦值方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2018-06-06
pycharm專業(yè)版遠程登錄服務(wù)器的詳細教程
這篇文章主要介紹了pycharm專業(yè)版遠程登錄服務(wù)器的詳細教程,本文給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2020-09-09
python正則表達式函數(shù)match()和search()的區(qū)別
match()和search()都是python中的正則匹配函數(shù),那這兩個函數(shù)有何區(qū)別呢?本文詳細介紹了這2個函數(shù)的區(qū)別2021-10-10

