最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

幾個關(guān)于python  Pdf 技巧的分享

 更新時間:2022年02月23日 10:43:58   作者:zzxiaoma  
這篇文章主要介紹了python使用技巧Pdf的詳細內(nèi)容,PyPDF2是一個純Python的開源庫,能夠分割或合并PDF文件,也可以裁剪或轉(zhuǎn)換PDF文件中的頁面,下面關(guān)于文章主題內(nèi)容將詳細介紹,需要的小伙伴可以參考一下

前言:

PyPDF2是一個純Python的開源庫,能夠分割或合并PDF文件,也可以裁剪或轉(zhuǎn)換PDF文件中的頁面。我們還可以使用PyPDF2查看PDF文件的元信息,對PDF文件進行加密等。

PyPDF2是一個開源的庫,因此在使用之前需要先安裝。

pip install PyPDF2

1.讀取PDF

import PyPDF2

reader = PyPDF2.PdfFileReader(open('a.pdf','rb'))
print(reader.getNumPages())

print(reader.getIsEncrypted())
print(reader.getDocumentInfo())
page = reader.getPage(8)
print(page.extractText())

首先導(dǎo)入PyPDF2模塊,然后以二進制讀模式打開a.pdf文件,并將它傳遞給PdfFileReader類的初始化函數(shù)。PdfFileReader的初始化函數(shù)會返回一個PdfFileReader類的對象,我們可以使用這個對象來獲取PDF文件的信息。

通過getNumPages函數(shù)獲取pdf的總頁數(shù),通過getIsEncrypted函數(shù)獲取文件是否加密,通過getDocumentInfo函數(shù)獲取文件的元數(shù)據(jù),通過傳遞下標給getPage函數(shù)的方式獲取PDF頁面,下標從0開始,與Python內(nèi)置的字符串、列表和元組等保持一致。通過PageObject類的extractText方法提取頁面中的文本。從該方法的返回結(jié)果來看,提取PDF文本的效果并不理想。

2.刪除pdf的某些頁

思路:PyPDF2并不能直接編輯PDF文件,但是我們可以利用PyPDF2從一個PDF文檔拷貝需要的頁面到另一個PDF文檔,通過這種迂回的方式實現(xiàn)編輯PDF的功能。例如刪掉a.pdf中的第一頁

import PyPDF2

reader = PyPDF2.PdfFileReader(open('a.pdf','rb'))
output = PyPDF2.PdfFileWriter()
for i in range(1,reader.getNumPages()):
? ? output.addPage(reader.getPage(i))
outputStream = open ("b.pdf","wb")
output.write(outputStream)
outputStream.close()

3.旋轉(zhuǎn)頁面

PageObject類中有部分方法可以修改PDF頁面,其中rotateClockwiserotateCounterClockwise方法用來旋轉(zhuǎn)頁面。這兩個方法只接受一個參數(shù),且參數(shù)取值必須是90的倍數(shù),表示旋轉(zhuǎn)多少度。

import PyPDF2

reader = PyPDF2.PdfFileReader(open('a.pdf','rb'))
output = PyPDF2.PdfFileWriter()
page = reader.getPage(0)
page.rotateClockwise(180)
output.addPage(page)
outputStream = open ("b.pdf","wb")
output.write(outputStream)
outputStream.close()

4.合并pdf

from PyPDF2 import PdfFileMerger

merger = PdfFileMerger()

a = open("a.pdf",'rb')
b = open("b.pdf",'rb')
c = open("c.pdf",'rb')

merger.append(fileobj = a,pages = (0,3))
merger.merge(position=2,fileobj=b,pages=(0,1))
merger.append(c)
output = open("d.pdf","wb")
merger.write(output)

append方法通過fileobj參數(shù)確定要添加的PDF文件,通過pages參數(shù)指定要將哪些PDF頁面添加到新的PDF文件中,并將要添加的頁面添加到merger對象的末尾。merge方法相對于append方法,增加了position參數(shù),我們可以通過position參數(shù)指定頁面插人的位置。append方法和merge方法的pages參數(shù)非常靈活,該參數(shù)是一個三元組(start,stop[,step]),分別表示起點、終點和步長。我們可以通過該參數(shù)指定合并PDF文件中的頁面。

到此這篇關(guān)于python使用技巧Pdf的詳細內(nèi)容介紹的文章就介紹到這了,更多相關(guān)python使用技巧Pdf介紹內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

最新評論

德保县| 宾阳县| 台东县| 离岛区| 遂川县| 麻城市| 黄冈市| 姜堰市| 商都县| 银川市| 平乐县| 辽中县| 榆林市| 沂源县| 崇明县| 琼中| 洛扎县| 化州市| 苍南县| 鹿泉市| 隆子县| 光泽县| 两当县| 博兴县| 星座| 高州市| 永靖县| 六安市| 资阳市| 鄂托克前旗| 竹北市| 金乡县| 乌苏市| 鄂托克旗| 安岳县| 鲜城| 凤台县| 新田县| 普安县| 芮城县| 镇江市|