Python解壓ZIP文件的三種實(shí)用技巧
在日常開發(fā),尤其是 AI 模型部署(如 YOLO、LLM 權(quán)重部署)中,我們經(jīng)常需要在 Linux 服務(wù)器或 Docker 容器中處理壓縮包。有時(shí)候容器里甚至沒(méi)有安裝 unzip 命令,這時(shí)候 Python 就成了我們的救命稻草。
本文總結(jié)了使用 Python 解壓 ZIP 文件的三種常用方法,涵蓋了從最簡(jiǎn)單的命令行操作到處理中文亂碼的進(jìn)階技巧。
方法一:命令行“一行流” (最快、無(wú)需寫腳本)
這是最簡(jiǎn)單、最快的方法。Python 標(biāo)準(zhǔn)庫(kù)自帶 zipfile 模塊,可以直接在終端調(diào)用,無(wú)需編寫任何 .py 文件。非常適合在 Docker 容器 或 臨時(shí)環(huán)境 中使用。
語(yǔ)法:
python -m zipfile -e <壓縮包名> <解壓目標(biāo)目錄>
示例:
將 model_weights.zip 解壓到當(dāng)前目錄(.):
python -m zipfile -e model_weights.zip .
原理:-m 參數(shù)將庫(kù)模塊當(dāng)作腳本運(yùn)行,-e 代表 extract(解壓)。
方法二:標(biāo)準(zhǔn)庫(kù)zipfile(基礎(chǔ)腳本)
如果你需要在 Python 代碼中集成解壓功能,zipfile 是最標(biāo)準(zhǔn)的選擇。建議使用 with 語(yǔ)句(上下文管理器),這樣可以確保文件在使用后自動(dòng)關(guān)閉,即使發(fā)生錯(cuò)誤也不會(huì)占用文件句柄。
import zipfile
import os
def unzip_file(zip_src, dst_dir):
# 如果目標(biāo)目錄不存在,則創(chuàng)建
if not os.path.exists(dst_dir):
os.makedirs(dst_dir)
print(f"開始解壓: {zip_src} ...")
try:
with zipfile.ZipFile(zip_src, 'r') as zfile:
# extractall 會(huì)解壓所有文件
zfile.extractall(path=dst_dir)
print(f"? 解壓完成,文件已保存至: {dst_dir}")
except zipfile.BadZipFile:
print("? 錯(cuò)誤: 文件已損壞或不是有效的 ZIP 文件")
except Exception as e:
print(f"? 發(fā)生未知錯(cuò)誤: {e}")
# 調(diào)用示例
if __name__ == "__main__":
unzip_file("merged_qwen3vl_model.zip", "./model_output")
方法三:進(jìn)階操作 (大文件進(jìn)度條 + 中文亂碼修復(fù))
作為 AI 開發(fā)者,我們解壓的模型往往高達(dá)幾 GB 甚至幾十 GB。如果沒(méi)有進(jìn)度條,對(duì)著黑屏傻等是非常焦慮的。此外,Windows 下打包的中文文件名在 Linux 下解壓常會(huì)出現(xiàn)亂碼。
下面的腳本解決了這兩個(gè)痛點(diǎn):
1. 依賴安裝
我們需要 tqdm 來(lái)顯示進(jìn)度條(做 AI 的同學(xué)應(yīng)該都有這個(gè)庫(kù)):
pip install tqdm
2. 完整代碼
import zipfile
import os
from tqdm import tqdm
def unzip_with_progress(zip_src, dst_dir):
if not os.path.exists(dst_dir):
os.makedirs(dst_dir)
with zipfile.ZipFile(zip_src, 'r') as zfile:
# 獲取所有文件列表
members = zfile.infolist()
# 初始化進(jìn)度條,total 是文件總大小
total_size = sum(file.file_size for file in members)
print(f"正在解壓 {zip_src} 到 {dst_dir} ...")
with tqdm(total=total_size, unit='B', unit_scale=True, unit_divisor=1024) as pbar:
for member in members:
# --- 中文亂碼修復(fù)核心代碼 (可選) ---
# Windows 壓縮包通常用 CP437 編碼文件名,Linux 需要轉(zhuǎn)回 GBK 或 UTF-8
try:
member.filename = member.filename.encode('cp437').decode('gbk')
except:
# 如果轉(zhuǎn)換失敗,保持原樣(說(shuō)明可能是 UTF-8)
pass
# --------------------------------
# 解壓?jiǎn)蝹€(gè)文件
zfile.extract(member, dst_dir)
# 更新進(jìn)度條
pbar.update(member.file_size)
if __name__ == "__main__":
# 示例:解壓一個(gè)大模型權(quán)重
unzip_with_progress("large_model_weights.zip", "./models")
總結(jié)
| 場(chǎng)景 | 推薦方法 | 核心命令/庫(kù) |
|---|---|---|
| 臨時(shí)操作/Docker環(huán)境 | 方法一 | python -m zipfile -e file.zip . |
| 通用腳本開發(fā) | 方法二 | import zipfile |
| 大文件/體驗(yàn)優(yōu)化 | 方法三 | zipfile + tqdm |
到此這篇關(guān)于Python解壓ZIP文件的三種實(shí)用技巧的文章就介紹到這了,更多相關(guān)Python解壓ZIP文件內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
Python如何根據(jù)關(guān)鍵字逐行提取文本內(nèi)容問(wèn)題
這篇文章主要介紹了Python如何根據(jù)關(guān)鍵字逐行提取文本內(nèi)容問(wèn)題,具有很好的參考價(jià)值,希望對(duì)大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2023-08-08
詳解PyCharm+QTDesigner+PyUIC使用教程
這篇文章主要介紹了詳解PyCharm+QTDesigner+PyUIC使用教程,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來(lái)一起學(xué)習(xí)學(xué)習(xí)吧2019-06-06
使用Python手工計(jì)算x的算數(shù)平方根,來(lái)自中國(guó)古人的數(shù)學(xué)智慧
本篇采用的計(jì)算方法既非二分法也非牛頓迭代法,而是把中國(guó)古代的手工計(jì)算平方根的方法轉(zhuǎn)成代碼來(lái)完成。代碼有點(diǎn)煩雜,算是拋磚引玉吧,期待高手們寫出更好的代碼來(lái)2021-09-09
Python multiprocessing.Manager介紹和實(shí)例(進(jìn)程間共享數(shù)據(jù))
這篇文章主要介紹了Python multiprocessing.Manager介紹和實(shí)例(進(jìn)程間共享數(shù)據(jù)),本文介紹了Manager的dict、list使用例子,同時(shí)介紹了namespace對(duì)象,需要的朋友可以參考下2014-11-11
Python程序設(shè)計(jì)入門(1)基本語(yǔ)法簡(jiǎn)介
Python是當(dāng)今日趨流行的一種腳本語(yǔ)言,它比Java更簡(jiǎn)單,比php更強(qiáng)大,并且還適用于做桌面應(yīng)用的開發(fā),這篇文章主要介紹了Python基本語(yǔ)法,需要的朋友可以參考下2014-06-06

