Python對(duì)130w+張圖片檢索的實(shí)現(xiàn)方法
任務(wù)說(shuō)明:
130w+張圖片,8張excel表里記錄了需要檢索圖片的文件名,現(xiàn)在需要找出對(duì)應(yīng)的圖片,將找出的圖片按不同的excel分別保存,并且在excel里能夠直接打開(kāi)圖片。
任務(wù)分析:
如果數(shù)據(jù)量不大的話,可以直接讀取excel表里的文件名進(jìn)行搜索保存,但這次的任務(wù)顯然不合適,因?yàn)閳D片實(shí)在太多,所以考慮后按照以下步驟:
1、遍歷圖片文件夾,讀取文件名和文件路徑,寫(xiě)入到csv文件中;
2、使用pandas的merge函數(shù),實(shí)現(xiàn)8張?jiān)糴xcel表與csv文件根據(jù)圖片文件名的對(duì)碰;
3、使用shutil的copy函數(shù),讀取文件路徑進(jìn)行保存。
代碼分析:
1、文件遍歷
import os
import pandas as pd
file_list = []
path_list = []
path = r"此處添加圖片路徑"
print("任務(wù)開(kāi)始")
for root,dirs,files in os.walk(path):
for file in files:
file_list.append(file.split('.')[0])
path_list.append(os.path.join(root,file))
print("文件遍歷結(jié)束")
file_dic = dict(zip(file_list,path_list))
df = pd.DataFrame.from_dict(file_dic,orient='index', columns=['圖片1路徑']).reset_index().rename(columns={'index':'圖片1'})
df.to_csv("圖片1.csv")
df = pd.DataFrame.from_dict(file_dic,orient='index', columns=['圖片2路徑']).reset_index().rename(columns={'index':'圖片2'})
df.to_csv("圖片2.csv")
df = pd.DataFrame.from_dict(file_dic,orient='index', columns=['圖片3路徑']).reset_index().rename(columns={'index':'圖片3'})
df.to_csv("圖片3.csv")
print("文件目錄導(dǎo)出成功")
2、表格對(duì)碰
import pandas as pd
frame1 = pd.read_excel(r'excel表1.xlsx', 'sheet名')
frame2 = pd.read_csv(r'圖片1.csv', sep=',')
frame3 = pd.read_csv(r'圖片2.csv', sep=',')
frame4 = pd.read_csv(r'圖片3.csv', sep=',')
frame5 = pd.merge(frame1, frame2, on = ['圖片1'], how = 'left')
frame6 = pd.merge(frame5, frame3, on = ['圖片2'], how = 'left')
frame7 = pd.merge(frame6, frame4, on = ['圖片3'], how = 'left')
col = ['圖片1','圖片2','圖片3']
frame7[col] = frame7[col].fillna('未找到')
frame7.to_excel('excel表1合并后.xlsx')
3、圖片復(fù)制
import shutil
target = '此處為excel表1導(dǎo)出圖片路徑'
copylist1 = frame7['圖片1']
for src in copylist1:
if src != '未找到':
shutil.copy(src, target)
copylist2 = frame7['圖片2']
for src in copylist2:
if src != '未找到':
shutil.copy(src, target)
copylist3 = frame7['圖片3']
for src in copylist3:
if src != '未找到':
shutil.copy(src, target)
print('復(fù)制完畢')
4、excel里打開(kāi)圖片,可以使用excel自帶的hyperlink函數(shù)。
總結(jié)
到此這篇關(guān)于Python對(duì)130w+張圖片檢索實(shí)現(xiàn)的文章就介紹到這了,更多相關(guān)Python圖片檢索內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
python?服務(wù)器批處理得到PSSM矩陣的問(wèn)題
這篇文章主要介紹了python?服務(wù)器批處理得到PSSM矩陣,本文給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下2022-07-07
Python人工智能之路 之PyAudio 實(shí)現(xiàn)錄音 自動(dòng)化交互實(shí)現(xiàn)問(wèn)答
關(guān)于音頻, PyAudio 這個(gè)庫(kù), 可以實(shí)現(xiàn)開(kāi)啟麥克風(fēng)錄音, 可以播放音頻文件等等。文章介紹了如何使用Python第三方庫(kù)PyAudio進(jìn)行麥克風(fēng)錄音然后自動(dòng)播放已經(jīng)合成的語(yǔ)音實(shí)現(xiàn)語(yǔ)音交互回答,需要的朋友可以參考下2019-08-08
python爬蟲(chóng)開(kāi)發(fā)之使用Python爬蟲(chóng)庫(kù)requests多線程抓取貓眼電影TOP100實(shí)例
這篇文章主要介紹了python爬蟲(chóng)開(kāi)發(fā)之使用Python爬蟲(chóng)庫(kù)requests多線程抓取貓眼電影TOP100實(shí)例,需要的朋友可以參考下2020-03-03
Python XML轉(zhuǎn)Json之XML2Dict的使用方法
今天小編就為大家分享一篇Python XML轉(zhuǎn)Json之XML2Dict的使用方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2019-01-01
Pandas如何將Timestamp轉(zhuǎn)為datetime類型
這篇文章主要介紹了Pandas如何將Timestamp轉(zhuǎn)為datetime類型,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2022-07-07
Python數(shù)據(jù)挖掘中常用的五種AutoEDA 工具總結(jié)
大家好,我們都知道在數(shù)據(jù)挖掘的過(guò)程中,數(shù)據(jù)探索性分析一直是非常耗時(shí)的一個(gè)環(huán)節(jié),但也是繞不開(kāi)的一個(gè)環(huán)節(jié),本篇文章帶你盤點(diǎn)數(shù)據(jù)挖掘中常見(jiàn)的5種 AutoEDA 工具2021-11-11
使用python解析xml成對(duì)應(yīng)的html示例分享
這篇文章主要介紹了使用python解析xml成對(duì)應(yīng)的html示例,需要的朋友可以參考下2014-04-04

