最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python 爬取免費(fèi)簡歷模板網(wǎng)站的示例

 更新時(shí)間:2020年09月27日 14:58:08   作者:straightup  
這篇文章主要介紹了python 爬取免費(fèi)簡歷模板網(wǎng)站的示例,幫助大家更好的理解和使用python 爬蟲,感興趣的朋友可以了解下

代碼

# 免費(fèi)的簡歷模板進(jìn)行爬取本地保存 
# http://sc.chinaz.com/jianli/free.html
# http://sc.chinaz.com/jianli/free_2.html

import requests
from lxml import etree
import os

dirName = './resumeLibs'
if not os.path.exists(dirName):
  os.mkdir(dirName)

headers = {
  'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/85.0.4183.83 Safari/537.36'
}
url = 'http://sc.chinaz.com/jianli/free_%d.html'
for page in range(1,2):
  if page == 1:
    new_url = 'http://sc.chinaz.com/jianli/free.html'
  else:
    new_url = format(url%page)
  page_text = requests.get(url=new_url,headers=headers).text
  tree = etree.HTML(page_text)
  a_list = tree.xpath('//div[@id="container"]/div/p/a')
  
  for a in a_list:
    a_src = a.xpath('./@href')[0]
    a_title = a.xpath('./text()')[0]
    a_title = a_title.encode('iso-8859-1').decode('utf-8')
    # 爬取下載頁面
    page_text = requests.get(url=a_src,headers=headers).text
    tree = etree.HTML(page_text)
    dl_src = tree.xpath('//div[@id="down"]/div[2]/ul/li[8]/a/@href')[0]
    
    resume_data = requests.get(url=dl_src,headers=headers).content
    resume_name = a_title
    resume_path = dirName + '/' + resume_name + '.rar'
    with open(resume_path,'wb') as fp:
      fp.write(resume_data)
      print(resume_name,'下載成功!')

爬取結(jié)果

以上就是python 爬取免費(fèi)簡歷模板網(wǎng)站的示例的詳細(xì)內(nèi)容,更多關(guān)于python 爬取網(wǎng)站的資料請(qǐng)關(guān)注腳本之家其它相關(guān)文章!

相關(guān)文章

最新評(píng)論

漾濞| 茌平县| 郑州市| 许昌市| 隆林| 色达县| 珲春市| 崇文区| 克山县| 会东县| 铜梁县| 阳曲县| 桦南县| 松阳县| 江陵县| 湖口县| 铜陵市| 辽阳市| 蒙城县| 连江县| 罗山县| 车险| 海伦市| 怀安县| 横山县| 互助| 乐昌市| 松阳县| 两当县| 赣州市| 达尔| 亳州市| 修文县| 治多县| 金乡县| 碌曲县| 灵山县| 翁牛特旗| 巴彦淖尔市| 奉新县| 通海县|