Python爬蟲將爬取的圖片寫入world文檔的方法
作為初學爬蟲的我,無論是爬取文字還是圖片,都可以游刃有余的做到,但是爬蟲所爬取的內(nèi)容往往不是單獨的圖片或者文字,于是我就想是否可以將圖文保存至world文檔里,一開始使用了如下方法保存圖片:
with open('123.doc','wb')as file:
file.write(response.content)
file.close()
結(jié)果就是,world文檔里出現(xiàn)了一堆亂碼,此法不同,我就開始另尋他法,找了很久也沒有找到,只找到了關于Python操作world的方法。
于是我就開始了新的思路:使用原來的方法將圖片保存下來,再將圖片添加到world文檔里,最后將圖片刪除。這里使用的是python-dox庫,代碼如下:
import requests
from bs4 import BeautifulSoup
import os
import docx
from docx import Document
from docx.shared import Inches
url = 'https://www.qiushibaike.com/article/119757360'
html = requests.get(url).content
soup = BeautifulSoup(html,'html.parser')
wen = soup.find('div',{"class":"content"}).text
img = str(soup.find('div',{"class":"thumb"})).split('src="')[1].split('"/')[0]
tu = 'https:' + img
img_name = img.split('/')[-1]
#保存圖片至本地
with open(img_name,'wb')as f:
response = requests.get(tu).content
f.write(response)
f.close()
document = Document()
document.add_paragraph(wen)#向文檔里添加文字
document.add_picture(img_name)#向文檔里添加圖片
document.save('tuwen.doc')#保存文檔
os.remove(img_name)#刪除保存在本地的圖片
最后,還是實現(xiàn)了將圖文保存在了world文檔里,盡管方法有些笨……
以上這篇Python爬蟲將爬取的圖片寫入world文檔的方法就是小編分享給大家的全部內(nèi)容了,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關文章
深入解析PYTHON?虛擬機令人拍案叫絕的字節(jié)碼設計
這篇文章主要為大家介紹了PYTHON虛擬機中令人拍案叫絕的字節(jié)碼設計深入詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步,早日升職加薪2023-04-04
Python實現(xiàn)根據(jù)Excel生成Model和數(shù)據(jù)導入腳本
最近遇到一個需求,有幾十個Excel,每個的字段都不一樣,然后都差不多是第一行是表頭,后面幾千上萬的數(shù)據(jù),需要把這些Excel中的數(shù)據(jù)全都加入某個已經(jīng)上線的Django項目。所以我造了個自動生成?Model和導入腳本的輪子,希望對大家有所幫助2022-11-11
網(wǎng)站滲透常用Python小腳本查詢同ip網(wǎng)站
這篇文章主要介紹了網(wǎng)站滲透常用Python小腳本查詢同ip網(wǎng)站,需要的朋友可以參考下2017-05-05
Python爬蟲獲取op.gg英雄聯(lián)盟英雄對位勝率的源碼
這篇文章主要介紹了Python爬蟲獲取op.gg英雄聯(lián)盟英雄對位勝率,本文給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2021-01-01

