python使用自定義user-agent抓取網頁的方法
更新時間:2015年04月15日 11:43:56 作者:令狐不聰
這篇文章主要介紹了python使用自定義user-agent抓取網頁的方法,涉及Python使用urllib2模塊操作網頁的技巧,需要的朋友可以參考下
本文實例講述了python使用自定義user-agent抓取網頁的方法。分享給大家供大家參考。具體如下:
下面python代碼通過urllib2抓取指定的url的內容,并且使用自定義的user-agent,可防止網站屏蔽采集器
import urllib2
req = urllib2.Request('http://192.168.1.2/')
req.add_header('User-agent', 'Mozilla 5.10')
res = urllib2.urlopen(req)
html = res.read()
希望本文所述對大家的Python程序設計有所幫助。
相關文章
使用python將mdb數(shù)據(jù)庫文件導入postgresql數(shù)據(jù)庫示例
mdb格式文件可以通過mdbtools工具將內中包含的每張表導出到csv格式文件。由于access數(shù)據(jù)庫和postgresQL數(shù)據(jù)庫格式上會存在不通性,所以使用python的文件處理,將所得csv文件修改成正確、能識別的格式2014-02-02
Pytorch 實現(xiàn)focal_loss 多類別和二分類示例
今天小編就為大家分享一篇Pytorch 實現(xiàn)focal_loss 多類別和二分類示例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2020-01-01
Python RuntimeError: thread.__init__() not called解決方法
這篇文章主要介紹了Python RuntimeError: thread.__init__() not called解決方法,需要的朋友可以參考下2015-04-04
pytorch創(chuàng)建tensor函數(shù)詳情
這篇文章主要介紹了pytorch創(chuàng)建tensor函數(shù)詳情,文章圍繞tensor函數(shù)的相關自來哦展開詳細內容的介紹,需要的小伙伴可以參考一下,希望對你有所幫助2022-03-03
從零學python系列之新版本導入httplib模塊報ImportError解決方案
在使用新版python打開舊版本代碼的時候,可能會有些報錯或者不兼容的情況出現(xiàn),今天我們就來分析其中的一種情況2014-05-05

