最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python實現(xiàn)為pdf添加水印功能

 更新時間:2022年04月02日 15:22:39   作者:KjPrime  
這篇文章主要介紹了Python實現(xiàn)給普通PDF添加水印的方法,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧

創(chuàng)建需要的水印模板

wps創(chuàng)建

輸出pdf

水印pdf

實現(xiàn)步驟

安裝依賴

pip install PyPDF2

代碼

import os
from PyPDF2 import PdfFileReader as pr
from PyPDF2 import PdfFileWriter as pw


def write_watermark(watermark_pdf_path: str, target_pdf_path: str):
    result_pdf = pw()
    pdf_file_name = os.path.basename(target_pdf_path)
    f_target = open(target_pdf_path, 'rb')
    f_watermark = open(watermark_pdf_path, 'rb')
    target_pdf = pr(f_target)
    watermark_page = pr(f_watermark).getPage(0)
    for page in range(target_pdf.getNumPages()):
        try: # 這一段try except是一個讓我超級麻煩的bug,讓我解決了一天。
            target_pdf.getPage(page).mergePage(watermark_page)
            result_pdf.addPage(target_pdf.getPage(page))
        except Exception as e:
            result_pdf.addPage(watermark_page)
    if not os.path.exists("output"):
        os.makedirs("output")
    result_pdf.write(open("output/已添加水印_" + pdf_file_name, 'wb'))
    f_target.close()
    f_watermark.close()


def folder_pdf_files(folder: str) -> list[str]:  # 一個文件夾里面有多少pdf文件
    file_list = []
    for a, b, c in os.walk(folder):
        if b == []:
            for filename in c:
                if filename[-3:].lower() == 'pdf':
                    file_path = os.path.join(a, filename)
                    file_list.append(file_path)
    print(folder, ": 有", len(file_list), "個pdf文件")
    return file_list


def group_write_watermark(path_array: list[str], watermark_pdf_path: str):  # 一組pdf文件添加水印
    for pdf_path in path_array:
        print(pdf_path, "添加水印中...")
        write_watermark(watermark_pdf_path, pdf_path)
    print("完成")


if __name__ == '__main__':
    watermark_pdf_path = "水印文件.pdf"
    folder_pdf = "目錄"  # 需要添加水印的pdf的目錄
    pdf_list = folder_pdf_files(folder_pdf)
    group_write_watermark(pdf_list, watermark_pdf_path)

問題

UnicodeEncodeError: ‘latin-1’ codec can’t encode characters in position 8-9: ordinal not in range(256)

如果出現(xiàn)該錯誤,可以參考以下內(nèi)容。

使用pypdf2出現(xiàn)編碼問題

報錯信息

‘latin-1’ codec can’t encode characters in position 8-11: ordinal not in range(256)

通常這情況是出現(xiàn)了中文字符編碼問題

以下是使用pypdf2復制 pdf 時報錯信息

//報錯信息
<ipython-input-1-4f7e1b354328> in <module>()
     14      output.addPage(p)
     15 with open('D:\\Program Files\\2.pdf', 'wb') as f:
---> 16     output.write(f)

D:\Program Files (x86)\anaconda\lib\site-packages\PyPDF2\pdf.py in write(self, stream)
    499                 md5_hash = md5(key).digest()
    500                 key = md5_hash[:min(16, len(self._encrypt_key) + 5)]
--> 501             obj.writeToStream(stream, key)
    502             stream.write(b_("\nendobj\n"))
    503 

D:\Program Files (x86)\anaconda\lib\site-packages\PyPDF2\generic.py in writeToStream(self, stream, encryption_key)
    547             key.writeToStream(stream, encryption_key)
    548             stream.write(b_(" "))
--> 549             value.writeToStream(stream, encryption_key)
    550             stream.write(b_("\n"))
    551         stream.write(b_(">>"))

D:\Program Files (x86)\anaconda\lib\site-packages\PyPDF2\generic.py in writeToStream(self, stream, encryption_key)
    470 
    471     def writeToStream(self, stream, encryption_key):
--> 472         stream.write(b_(self))
    473 
    474     def readFromStream(stream, pdf):

D:\Program Files (x86)\anaconda\lib\site-packages\PyPDF2\utils.py in b_(s)
    236             return s
    237         else:
--> 238             r = s.encode('latin-1')
    239             if len(s) < 2:
    240                 bc[s] = r

UnicodeEncodeError: 'latin-1' codec can't encode characters in position 8-11: ordinal not in range(256)

解決方法

1、修改pypdf2包中的generic.py文件

由于我使用的是anaconda,路徑為anaconda\Lib\site-packages\PyPDF2\generic.py

generic.py文件第488行原文

try:
   return NameObject(name.decode('utf-8'))
   except (UnicodeEncodeError, UnicodeDecodeError) as e:
   # Name objects should represent irregular characters
   # with a '#' followed by the symbol's hex number
   if not pdf.strict:
      warnings.warn("Illegal character in Name Object", utils.PdfReadWarning)
      return NameObject(name)
   else:
      raise utils.PdfReadError("Illegal character in Name Object")

改成

try:
     return NameObject(name.decode('utf-8'))
 except (UnicodeEncodeError, UnicodeDecodeError) as e:
     try:
         return NameObject(name.decode('gbk'))
     except (UnicodeEncodeError, UnicodeDecodeError) as e:
         # Name objects should represent irregular characters
         # with a '#' followed by the symbol's hex number
         if not pdf.strict:
             warnings.warn("Illegal character in Name Object", utils.PdfReadWarning)
             return NameObject(name)
         else:
             raise utils.PdfReadError("Illegal character in Name Object")

2、修改pypdf2包中的utils.py文件

utils.py238行原文

 r = s.encode('latin-1')
 if len(s) < 2:
   		bc[s] = r
 return r

修改為

try:
    r = s.encode('latin-1')
    if len(s) < 2:
        bc[s] = r
    return r
except Exception as e:
    print(s)
    r = s.encode('utf-8')
    if len(s) < 2:
        bc[s] = r
    return r

問題解決

感悟

此代碼的創(chuàng)新點在于可以實現(xiàn)文件夾遍歷添加水印。

其實第一點也沒有什么,我感覺我最有成功感的就是write_watermark函數(shù)里那段try except語句處,這個一段代碼解決pdf空白頁而發(fā)送的錯誤。解決了一天,網(wǎng)絡(luò)上都沒有解決方法。我摸著石頭過河。

有一個問題就是,這個代碼對于圖片pdf的水印效果不好,因為圖片pdf的也頁面大小比普通的文字pdf大一些,難以控制水印的位置。我想的是在創(chuàng)建水印pdf的時候就把pdf的大小放大。

到此這篇關(guān)于Python實現(xiàn)為pdf添加水印功能的文章就介紹到這了,更多相關(guān)Python pdf水印內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • Python使用Pandas處理缺失值的技巧分享

    Python使用Pandas處理缺失值的技巧分享

    爬蟲抓取的數(shù)據(jù)就像剛從泥坑里挖出來的土豆,表面沾滿泥土(缺失值、重復值、異常值),內(nèi)部可能還有壞掉的部分(無效數(shù)據(jù)),本文聚焦最讓人頭疼的缺失值問題,用Python的Pandas庫演示如何像處理食材一樣清洗數(shù)據(jù),讓臟數(shù)據(jù)變成可直接分析的凈數(shù)據(jù),需要的朋友可以參考下
    2025-10-10
  • python發(fā)送byte數(shù)據(jù)組到tcp的server問題

    python發(fā)送byte數(shù)據(jù)組到tcp的server問題

    這篇文章主要介紹了python發(fā)送byte數(shù)據(jù)組到tcp的server問題,具有很好的參考價值,希望對大家有所幫助,如有錯誤或未考慮完全的地方,望不吝賜教
    2023-09-09
  • Python實現(xiàn)計算最小編輯距離

    Python實現(xiàn)計算最小編輯距離

    這篇文章主要介紹了Python實現(xiàn)計算最小編輯距離的相關(guān)代碼,有需要的小伙伴可以參考下
    2016-03-03
  • Matplotlib與NumPy結(jié)合使用技術(shù)代碼和案例詳解

    Matplotlib與NumPy結(jié)合使用技術(shù)代碼和案例詳解

    這篇文章主要介紹了Matplotlib和NumPy的基本使用方法,并通過一些具體的案例展示了如何將它們結(jié)合使用來處理和可視化數(shù)據(jù),文中通過代碼介紹的非常詳細,需要的朋友可以參考下
    2024-12-12
  • Python實現(xiàn)Mysql數(shù)據(jù)庫連接池實例詳解

    Python實現(xiàn)Mysql數(shù)據(jù)庫連接池實例詳解

    這篇文章主要介紹了Python實現(xiàn)Mysql數(shù)據(jù)庫連接池實例詳解的相關(guān)資料,需要的朋友可以參考下
    2017-04-04
  • python-字典dict和集合set

    python-字典dict和集合set

    這篇文章主要介紹了python-字典dict和集合set,字典是python中的一種數(shù)據(jù)結(jié)構(gòu)。集合(set)與字典相同均存儲key,但只存儲key,key不可重復,所以set中的值不可重復,而且是無序,下面來看看更多相關(guān)內(nèi)容吧
    2021-12-12
  • Nginx+Uwsgi+Django 項目部署到服務(wù)器的思路詳解

    Nginx+Uwsgi+Django 項目部署到服務(wù)器的思路詳解

    這篇文章主要介紹了Nginx+Uwsgi+Django 項目部署到服務(wù)器的思路,本文通過實例代碼給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下
    2020-05-05
  • Python OpenCV一個窗口中顯示多幅圖像

    Python OpenCV一個窗口中顯示多幅圖像

    大家好,本篇文章主要講的是Python OpenCV一個窗口中顯示多幅圖像,感興趣的同學趕快來看一看吧,對你有幫助的話記得收藏一下,方便下次瀏覽
    2022-01-01
  • 使用BeeWare實現(xiàn)iOS調(diào)用Python方式

    使用BeeWare實現(xiàn)iOS調(diào)用Python方式

    這篇文章主要介紹了使用BeeWare實現(xiàn)iOS調(diào)用Python方式,具有很好的參考價值,希望對大家有所幫助,如有錯誤或未考慮完全的地方,望不吝賜教
    2023-12-12
  • 用python實現(xiàn)學生信息管理系統(tǒng)

    用python實現(xiàn)學生信息管理系統(tǒng)

    這篇文章主要為大家詳細介紹了用python實現(xiàn)學生信息管理系統(tǒng),文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們可以參考一下
    2022-07-07

最新評論

平泉县| 彭州市| 密山市| 茶陵县| 新郑市| 托克逊县| 陆丰市| 北辰区| 嵩明县| 鹰潭市| 鹤庆县| 朔州市| 孝感市| 车致| 盱眙县| 宜君县| 佳木斯市| 韶关市| 得荣县| 河东区| 南陵县| 济阳县| 汽车| 沧州市| 南丰县| 武胜县| 尼木县| 新巴尔虎左旗| 丽水市| 鄱阳县| 桃源县| 尖扎县| 长子县| 丰宁| 康定县| 西林县| 双流县| 江川县| 宁乡县| 淳安县| 长治市|