最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Pyhton多線程采集圖片方式

 更新時間:2023年12月01日 09:08:05   作者:三省同學  
這篇文章主要介紹了Pyhton多線程采集圖片方式,具有很好的參考價值,希望對大家有所幫助,如有錯誤或未考慮完全的地方,望不吝賜教

前言

需要大量圖片做數據采集是,這個時候就需要用到python獲取圖片,本篇以python多線程獲取圖片為例。

一、查看頁面元素

查看頁面源代碼。

二、請求url查看

通過F12查看請求url。

tn: resultjson_com
logid: 12339447258259285711
ipn: rj
ct: 201326592
is: 
fp: result
fr: 
word: 動漫圖片
queryWord: 動漫圖片
cl: 2
lm: -1
ie: utf-8
oe: utf-8
adpicid: 
st: -1
z: 
ic: 
hd: 
latest: 
copyright: 
s: 
se: 
tab: 
width: 
height: 
face: 0
istype: 2
qc: 
nc: 1
expermode: 
nojc: 
isAsync: 
pn: 60
rn: 30
gsm: 3c
1669373933133: 

代碼實現

# -*- coding: utf-8 -*-
import os
import re
import time
from multiprocessing import Pool
import requests
from multiprocessing.dummy import Pool as ThreadPool  # 線程池


def get_image(keyword, page_num, save_dir):
    # 瀏覽器偽裝
    header = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/78.0.3904.108 Safari/537.36'}
    # 請求url
    url = 'https://image.baidu.com/search/acjson?'
    n = 0;
    pn = 1  # pn是從第幾張圖片開始
    page_num = page_num + 1;
    for m in range(1, page_num):
        # 請求參數
        param = {'tn': 'resultjson_com',
                 'ipn': 'rj',
                 'ct': 201326592,
                 'is': '',
                 'fp': 'result',
                 'queryWord': keyword,
                 'cl': 2,
                 'lm': -1,
                 'ie': 'utf-8',
                 'oe': 'utf-8',
                 'adpicid': '',
                 'st': -1,
                 'z': '',
                 'ic': '',
                 'hd': 1,
                 'latest': '',
                 'copyright': '',
                 'word': keyword,
                 's': '',
                 'se': '',
                 'tab': '',
                 'width': '',
                 'height': '',
                 'face': 0,
                 'istype': 2,
                 'qc': '',
                 'nc': '1',
                 'fr': '',
                 'expermode': '',
                 'force': '',
                 'cg': '',
                 'pn': pn,
                 'rn': '30',
                 'gsm': '1e',
                 '1669373933133': ' '
                 }
        request = requests.get(url=url, headers=header, params=param)
        if request.status_code == 200:
            print('success.')
        request.encoding = 'utf-8'
        html = request.text
        image_url_list = re.findall('"thumbURL":"(.*?)",', html, re.S)
        if not os.path.exists(save_dir):
            os.makedirs(save_dir)

        for image_url in image_url_list:
            image_data = requests.get(url=image_url, headers=header).content
            # with open(os.path.join(save_dir, "{}_{:06d}.jpg".format("1", n)), 'wb') as fp:
            #     fp.write(image_data)
            pool.apply_async(download, args=(n, image_data, save_dir), error_callback=func.err_call_back)
            n = n + 1
        pn += 29

class Func(object):
    def __init__(self):
        # 利用匿名函數模擬一個不可序列化象
        # 更常見的錯誤寫法是,在這里初始化一個數據庫的長鏈接
        self.num = lambda: None

    def work(self, num=None):
        self.num = num
        return self.num

    @staticmethod
    def call_back(res):
        print('Hello,World! {res}')

    @staticmethod
    def err_call_back(err):
        print('出錯啦:[{}]'.format(err))


def download(n, image_data, save_dir):
    # time.sleep(1)
    fp = open(os.path.join(save_dir, "{}_{:06d}.jpg".format("1", n)), 'wb')
    fp.write(image_data)
    fp.close()


if __name__ == '__main__':
    func = Func()
    keyword = '動漫圖片'
    save_dir = keyword
    page_num = int(input("頁數:"))
    # 線程池中線程數
    pool = Pool(10)
    # pool = ThreadPool(5)
    # i = 0;
    # while i < page_num:
    get_image(keyword, page_num, save_dir)
        # i = i + 1
    print('完成')

總結

以上為個人經驗,希望能給大家一個參考,也希望大家多多支持腳本之家。

相關文章

  • 50行Python代碼獲取高考志愿信息的實現方法

    50行Python代碼獲取高考志愿信息的實現方法

    這篇文章主要介紹了50行Python代碼獲取高考志愿信息的實現方法,本文給大家介紹的非常詳細,具有一定的參考借鑒價值,需要的朋友可以參考下
    2019-07-07
  • Python裝飾器模式定義與用法分析

    Python裝飾器模式定義與用法分析

    這篇文章主要介紹了Python裝飾器模式定義與用法,結合實例形式分析了Python裝飾器模式的具體定義、使用方法及相關操作技巧,需要的朋友可以參考下
    2018-08-08
  • python3實現Dijkstra算法最短路徑的實現

    python3實現Dijkstra算法最短路徑的實現

    這篇文章主要介紹了python3實現Dijkstra算法最短路徑的實現,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2021-05-05
  • 成功解決ValueError:?Supported?target?types?are:('binary',?'multiclass').?Got?'continuous'?instead.

    成功解決ValueError:?Supported?target?types?are:('binary

    本文給大家分享成功解決ValueError:?Supported?target?types?are:('binary',?'multiclass').?Got?'continuous'?instead.的錯誤問題,需要的朋友可以參考下
    2023-03-03
  • python實現中文轉換url編碼的方法

    python實現中文轉換url編碼的方法

    這篇文章主要介紹了python實現中文轉換url編碼的方法,結合實例形式分析了Python針對中文的gbk與utf-8編碼轉換的相關技巧,具有一定參考借鑒價值,需要的朋友可以參考下
    2016-06-06
  • selenium攜帶cookies模擬登陸CSDN的實現

    selenium攜帶cookies模擬登陸CSDN的實現

    這篇文章主要介紹了selenium攜帶cookies模擬登陸CSDN的實現,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2021-01-01
  • 教你使用一行Python代碼玩遍童年的小游戲

    教你使用一行Python代碼玩遍童年的小游戲

    這篇文章主要介紹了一行Python代碼玩遍童年的小游戲,幫助大家重回童年快樂時光,代碼簡單易懂,感興趣的朋友一起學習下吧
    2021-08-08
  • Tensorflow 查看變量的值方法

    Tensorflow 查看變量的值方法

    今天小編就為大家分享一篇Tensorflow 查看變量的值方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-06-06
  • python保存字典數據到csv文件的完整代碼

    python保存字典數據到csv文件的完整代碼

    在實際數據分析過程中,我們分析用Python來處理數據(海量的數據),我們都是把這個數據轉換為Python的對象的,比如最為常見的字典,下面這篇文章主要給大家介紹了關于python保存字典數據到csv的相關資料,需要的朋友可以參考下
    2022-06-06
  • python 序列解包的多種形式及用法解析

    python 序列解包的多種形式及用法解析

    這篇文章主要介紹了python 序列解包的多種形式及用法解析,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教
    2021-05-05

最新評論

平泉县| 靖远县| 沈丘县| 铜鼓县| 中宁县| 温泉县| 通渭县| 黔南| 鄂托克旗| 华安县| 鄂州市| 阳新县| 南漳县| 新乡县| 崇仁县| 岑巩县| 赫章县| 湘潭市| 农安县| 嘉义县| 鄂温| 麻江县| 南充市| 定结县| 于田县| 咸宁市| 忻州市| 南皮县| 那坡县| 遂川县| 调兵山市| 若羌县| 蕉岭县| 德惠市| 浪卡子县| 鱼台县| 新巴尔虎右旗| 龙山县| 台南县| 章丘市| 河北省|