Windows和Linux下使用Python搭建一個圖片OCR工具
識別結(jié)果效果

案例參考圖片

一、安裝系統(tǒng)級依賴
Windows 系統(tǒng)
在 Windows 系統(tǒng)下,從 Python 官方網(wǎng)站 下載 Python 3.10 版本安裝包,安裝時勾選 “Add Python to PATH” 選項。
Linux 系統(tǒng)
在 Linux 系統(tǒng)下,安裝 Python 3.10 及常用開發(fā)組件:
sudo apt update sudo apt install -y \ python3.10 \ python3.10-venv \ python3.10-dev \ python3.10-distutils \ python3-pip
這些組件分別用于:
python3.10:Python 解釋器venv:虛擬環(huán)境支持dev / distutils:編譯與打包依賴pip:Python 包管理工具
二、創(chuàng)建并激活虛擬環(huán)境
1. 創(chuàng)建虛擬環(huán)境
python -m venv paddle_py10
2. 激活虛擬環(huán)境
Windows 系統(tǒng)
paddle_py10\\Scripts\\activate
Linux 系統(tǒng)
source paddle_py10/bin/activate
激活成功后,終端前會顯示:
(paddle_py10)
三、安裝 PaddlePaddle(CPU 版本)
在虛擬環(huán)境中安裝 PaddlePaddle CPU 版(適用于 Windows 和 Linux):
python -m pip install paddlepaddle -i https://www.paddlepaddle.org.cn/packages/stable/cpu/
說明:
- 使用官方國內(nèi)鏡像,下載速度更快
- 該版本適合 無 GPU / CPU 推理環(huán)境
- 自動檢測操作系統(tǒng)并安裝相應(yīng)版本
四、安裝 PDF 相關(guān)依賴
1. 安裝 PyMuPDF(PDF 解析)
pip install PyMuPDF
主要用于:
- PDF 頁面解析
- 文本 / 圖片提取
- PDF 轉(zhuǎn)圖片(OCR 前處理)
2. 安裝 PaddleX(含 OCR 模塊)
pip install "paddlex[ocr]"
功能包括:
- OCR 模型封裝
- 文本檢測 / 識別
- 表格與版面分析
3. 安裝 ReportLab(PDF 生成)
pip install reportlab
完整代碼
from paddleocr import PaddleOCRVL
from PIL import Image
import numpy as np
pipeline = PaddleOCRVL(
device="cpu"
)
img = Image.open(
"v2-f644e32ef8fb2b15b6dd7218eff5f844_r.jpg"
).convert("RGB")
# resize
max_side = 1024
w, h = img.size
scale = min(max_side / w, max_side / h, 1.0)
img = img.resize((int(w * scale), int(h * scale)))
# 重要一步:PIL → numpy (防止CPU超過內(nèi)存)
img_np = np.array(img)
output = pipeline.predict(img_np)
for res in output:
res.print()
res.save_to_json(save_path="output")
res.save_to_markdown(save_path="output")

輸出目錄示例(Windows)
(paddle_py10) C:\workspace\output> dir
1768203146_1313.md
1768203146_1313_res.json
輸出目錄示例(Linux)
(paddle_py10) user@machine:/home/user/workspace/output$ tree
├── 1768203146_1313.md
└── 1768203146_1313_res.json
0 directories, 4 files
轉(zhuǎn)PDF和word請參考相關(guān)文章參考:
到此這篇關(guān)于Windows和Linux下使用Python搭建一個圖片OCR工具的文章就介紹到這了,更多相關(guān)Python圖片OCR內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
python目標(biāo)檢測基于opencv實現(xiàn)目標(biāo)追蹤示例
這篇文章主要為大家介紹了python基于opencv實現(xiàn)目標(biāo)追蹤示例,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪2022-05-05
Python類中方法種類與修飾符從基礎(chǔ)到實戰(zhàn)詳解
在Python面向?qū)ο缶幊讨?方法有不同的種類和修飾符,它們各自有著特定的用途和行為,本文將全面解析Python中的各種方法類型,并通過一個綜合案例幫助你徹底掌握這些概念,需要的朋友可以參考下2025-07-07
Python如何使用BeautifulSoup爬取網(wǎng)頁信息
這篇文章主要介紹了Python如何使用BeautifulSoup爬取網(wǎng)頁信息,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友可以參考下2019-11-11
通過Python使用saltstack生成服務(wù)器資產(chǎn)清單
人工去對每一臺服務(wù)器的硬件信息并記錄早已經(jīng)過去了,無論通過腳本還是自動化工具都是可以進(jìn)行一次編寫到處抓取的,本文主要使用saltstack作為使用工具,然后利用其提供的APi編寫所需的Python腳本2016-03-03
Python新手入門指南之如何極速搭建開發(fā)環(huán)境
Python在軟件開發(fā)領(lǐng)域占據(jù)重要地位,廣泛應(yīng)用于Web開發(fā),數(shù)據(jù)分析,人工智能及自動化腳本等領(lǐng)域,本文我們就來看看如何快速搭建Python開發(fā)環(huán)境吧2025-06-06

