最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python實現(xiàn)強制復(fù)制粘貼的示例詳解

 更新時間:2022年12月18日 08:17:40   作者:嗨學(xué)編程  
下個文檔還要馬內(nèi)?還好我會Python,本文就來教大家來一手如何利用Python實現(xiàn)強制復(fù)制粘貼。文中的示例代碼講解詳細,感興趣的小伙伴可以了解一下

前因后果

公司有人陽了,今天在家上班,突然小姨子就問我有沒有baidu文庫會員,想下載點東西,我心想這還要會員?用Python不是分分鐘的事情!

然后我非常自信的告訴她不用會員隨便下載,結(jié)果她順勢想來我家,還問我她姐姐在不在家,趁我一個人在家過來想干嘛?本著男孩子一個人在家要好好保護自己的原則,于是我過段拒絕了她!

兄弟們我做的對嗎?

咱們來開始今天的內(nèi)容,咱們不僅要強制復(fù)制粘貼,還要自動保存到world文檔,就問你刑不刑!

需要的模塊

requests  # 數(shù)據(jù)請求模塊
docx  # 文檔保存 
re    # 內(nèi)置模塊 不需要安裝

除了 re 模塊,前面兩個都是第三方模塊,需要手動安裝,win+r 打開運行框輸入cmd,點擊確定彈出命令提示符窗口輸入 pip install 加上模塊名即可。

docx 需要加上Python ,pip install python-docx

流程思路

基本思路流程

一、分析數(shù)據(jù)來源

找文檔數(shù)據(jù)內(nèi)容, 是在那個url里面生成的,通過開發(fā)者工具進行抓包分析。

  • 打開開發(fā)者工具: F12 / 鼠標右鍵點擊檢查選擇network
  • 刷新網(wǎng)頁: 讓本網(wǎng)頁數(shù)據(jù)內(nèi)容重新加載一遍,如果你是非VIP賬號, 看數(shù)據(jù), 圖片形式 —> 把數(shù)據(jù)<圖片> 獲取下來 —> 做文字識別;
  • 分析文庫數(shù)據(jù)內(nèi)容,,圖片所在地址;
  • 獲取所有圖片內(nèi)容: 文庫數(shù)據(jù) --> 圖片形式 —> 所有圖片內(nèi)容保存下載
  • 文字識別, 把圖片文字識別出來, 保存word文檔里面

二、代碼實現(xiàn)步驟

1.發(fā)送請求, 模擬瀏覽器對于url地址發(fā)送請求

圖片數(shù)據(jù)包:

2.獲取數(shù)據(jù), 獲取服務(wù)器返回響應(yīng)數(shù)據(jù)

開發(fā)者工具: response

3.解析數(shù)據(jù), 提取圖片鏈接地址

4.保存數(shù)據(jù), 把圖片內(nèi)容保存到本地文件夾

5.做文字識別, 識別文字內(nèi)容

6.把文字數(shù)據(jù)信息, 保存word文檔里面

代碼展示

導(dǎo)入模塊

# 導(dǎo)入數(shù)據(jù)請求模塊
import requests
# 導(dǎo)入格式化輸出模塊
from pprint import pprint
# 導(dǎo)入base64
import base64
# 導(dǎo)入os模塊
import os
# 導(dǎo)入文檔模塊
from docx import Document
# 導(dǎo)入正則
import re
# 導(dǎo)入json
import json

文字識別:

1. 注冊一個百度云API賬號

2. 創(chuàng)建應(yīng)用 并且去免費領(lǐng)取資源

3. 在技術(shù)文檔里面 Access Token獲取

4. 調(diào)用API接口來做文字識別

client_id 為官網(wǎng)獲取的AK, client_secret 為官網(wǎng)獲取的SK

host = 'https://aip.baidubce.com/oauth/2.0/token?grant_type=client_credentials&client_id=Gu7BGsfoKFZjLGvOKP7WezYv&client_secret=rGa2v2FcVnxBDFlerSW5H0D2eO7nRxdp'
response = requests.get(host)
access_token = response.json()['access_token']

通用文字識別(高精度版)

request_url = "https://aip.baidubce.com/rest/2.0/ocr/v1/accurate_basic"

二進制方式打開圖片文件

f = open(file, 'rb')
img = base64.b64encode(f.read())
params = {"image":img}
request_url = request_url + "?access_token=" + access_token
headers = {'content-type': 'application/x-www-form-urlencoded'}
json_data = requests.post(request_url, data=params, headers=headers).json()

列表推導(dǎo)式

words = '\n'.join([i['words'] for i in json_data['words_result']])
return words

讀取文件夾里面所有圖片內(nèi)容

content_list = []
files = os.listdir('img\\')
for file in files:
    filename = 'img\\' + file
    words = get_content(file=filename)
    print(words)
    content_list.append(words)

保存word文檔里面

doc = Document()
# 添加第一段文檔內(nèi)容
content = '\n'.join(content_list)
doc.add_paragraph(content)
doc.save('data.docx')

發(fā)送請求,模擬瀏覽器對于url地址發(fā)送請求。

請求頭

headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/101.0.0.0 Safari/537.36'
}
html_data = requests.get(url=link, headers=headers).text
json_data = json.loads(re.findall('var pageData = (.*?);', html_data)[0])
pprint(json_data)
for j in json_data['aggInfo']['docList']:
    name = j['title']  # 名字
    score = j['score'] # 評分
    viewCount = j['viewCount'] # 閱讀量
    downloadCount = j['downloadCount'] # 下載量
    docId = j['docId'] # 數(shù)據(jù)包ID

確定請求鏈接

url = 'https://wenku.baidu.com/gsearch/rec/pcviewdocrec'

請求參數(shù)

data = {
    'docId': docId,
    'query': name,
    'recPositions': ''
}

請求頭

headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/101.0.0.0 Safari/537.36'
}

發(fā)送請求

response = requests.get(url=url, params=data, headers=headers)

獲取數(shù)據(jù), 獲取服務(wù)器返回響應(yīng)數(shù)據(jù)

  • response.json() 獲取響應(yīng)json字典數(shù)據(jù), 但是返回數(shù)據(jù)必須是完整json數(shù)據(jù)格式 花括號 {}
  • response.text 獲取響應(yīng)文本數(shù)據(jù), 返回字符串 任何時候都可以, 但是基本獲取網(wǎng)頁源代碼的時候
  • response.content 獲取響應(yīng)二進制數(shù)據(jù), 返回字節(jié) 保存圖片/音頻/視頻/特定格式文件

解析數(shù)據(jù), 提取圖片鏈接地址

字典取值: 鍵值對 根據(jù)冒號左邊內(nèi)容[鍵], 提取冒號右邊的內(nèi)容[值]

for循環(huán)遍歷, 把列表里面元素一個一個提取出來

# 定義文件名 整型
num = 1
# for循環(huán)遍歷, 把列表里面元素一個一個提取出來
for index in response.json()['data']['relateDoc']:
    # index 字典呀
    pic = index['pic']
    print(pic)

保存數(shù)據(jù) 發(fā)送請求 + 獲取數(shù)據(jù) 二進制數(shù)據(jù)內(nèi)容

img_content = requests.get(url=pic, headers=headers).content
# 'img\\'<文件夾名字> + str(num)<文件名> + '.jpg'<文件后綴>  mode='wb' 保存方式, 二進制保存
# str(num) 強制轉(zhuǎn)換成 字符串
# '圖片\\' 相對路徑, 相對于你代碼的路徑 你代碼在那個地方, 那個代碼所在地方圖片文件夾
with open('圖片\\' + str(num) + '.jpg', mode='wb') as f:
    # 寫入數(shù)據(jù) 保存數(shù)據(jù)  把圖片二進制數(shù)據(jù)保存
    f.write(img_content)
# 每次循環(huán) + 1
print(num)
num += 1

效果展示

world文檔

以上就是Python實現(xiàn)強制復(fù)制粘貼的示例詳解的詳細內(nèi)容,更多關(guān)于Python強制復(fù)制粘貼的資料請關(guān)注腳本之家其它相關(guān)文章!

相關(guān)文章

  • PyTorch實現(xiàn)FedProx聯(lián)邦學(xué)習(xí)算法

    PyTorch實現(xiàn)FedProx聯(lián)邦學(xué)習(xí)算法

    這篇文章主要為大家介紹了PyTorch實現(xiàn)FedProx的聯(lián)邦學(xué)習(xí)算法,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步,早日升職加薪
    2022-05-05
  • 基于Opencv制作的美顏相機帶你領(lǐng)略美顏特效的效果

    基于Opencv制作的美顏相機帶你領(lǐng)略美顏特效的效果

    最關(guān)于美顏類相機最重要的是第一步:人臉檢測,本篇文章中是采用openCV開源庫實現(xiàn),文中給大家介紹的非常詳細,對大家的學(xué)習(xí)或工作具有一定的參考借鑒價值
    2021-09-09
  • Python讀取MRI并顯示為灰度圖像實例代碼

    Python讀取MRI并顯示為灰度圖像實例代碼

    這篇文章主要介紹了Python讀取MRI并顯示為灰度圖像實例代碼,具有一定借鑒價值,需要的朋友可以參考下
    2018-01-01
  • keras 自定義loss model.add_loss的使用詳解

    keras 自定義loss model.add_loss的使用詳解

    這篇文章主要介紹了keras 自定義loss model.add_loss的使用詳解,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-06-06
  • Python編寫打字訓(xùn)練小程序

    Python編寫打字訓(xùn)練小程序

    這篇文章主要介紹了Python編寫打字訓(xùn)練小程序,需要的朋友可以參考下
    2019-09-09
  • Python安裝Matplotlib包完整步驟記錄

    Python安裝Matplotlib包完整步驟記錄

    這篇文章主要給大家介紹了關(guān)于Python安裝Matplotlib包的相關(guān)資料,Matplotlib是一個Python 2D繪圖庫,它以多種硬拷貝格式和跨平臺的交互式環(huán)境生成出版物質(zhì)量的圖形,需要的朋友可以參考下
    2023-12-12
  • Python 通過xpath屬性爬取豆瓣熱映的電影信息

    Python 通過xpath屬性爬取豆瓣熱映的電影信息

    我喜歡看電影,可以說大部分熱門電影我都看過。處理愛好的目的,我看了看豆瓣熱映的電影列表。于是我寫了這個爬蟲把豆瓣熱映的電影都爬了下來。對頁面的處理主要是需要點擊顯示全部電影,然后爬取影片屬性,最后輸出文本。采用的還是scrapy框架。順便聊聊我的實現(xiàn)過程吧
    2021-11-11
  • python實現(xiàn)自動化腳本編寫

    python實現(xiàn)自動化腳本編寫

    自動化在很多時候是很方便的,本文以修改用戶名密碼單元為案例,編寫測試腳本。完成修改用戶名密碼模塊單元測試,感興趣的可以了解一下
    2021-06-06
  • Python著名游戲?qū)崙?zhàn)之方塊連接 我的世界

    Python著名游戲?qū)崙?zhàn)之方塊連接 我的世界

    讀萬卷書不如行萬里路,學(xué)的扎不扎實要通過實戰(zhàn)才能看出來,本篇文章手把手帶你模仿著名游戲——我的世界,大家可以在過程中查缺補漏,看看自己掌握程度怎么樣
    2021-10-10
  • Python3邏輯運算符與成員運算符

    Python3邏輯運算符與成員運算符

    這篇文章主要介紹了Python3邏輯運算符與成員運算符,文章圍繞主題展開詳細的內(nèi)容介紹,具有一定的參考價值,需要的朋友可以參考一下
    2022-09-09

最新評論

安庆市| 沛县| 汽车| 通辽市| 金门县| 上蔡县| 乐至县| 益阳市| 潜山县| 岳普湖县| 文登市| 黑龙江省| 沙河市| 桃江县| 汾阳市| 桂平市| 仙游县| 崇文区| 海口市| 临江市| 阿合奇县| 孟州市| 福鼎市| 彩票| 临沭县| 牡丹江市| 兴和县| 赤水市| 淳安县| 湄潭县| 吉林市| 洛隆县| 西城区| 黑龙江省| 绥宁县| 昌都县| 体育| 海林市| 仁化县| 昆明市| 高陵县|