使用Python制作一個(gè)翻譯器
一、用Python做一個(gè)翻譯器
之前有分享過(guò)gradio制作web App,我們今天就基于此做一個(gè)翻譯器。文末有試用訪問(wèn)哦,歡迎點(diǎn)擊。
1.產(chǎn)品說(shuō)明
實(shí)現(xiàn)一個(gè)中英翻譯器,輸入中文或者英文,輸出對(duì)應(yīng)的英文或者中文,目的是給學(xué)習(xí)英文的用戶,提供單詞解釋服務(wù)。使用方式為手機(jī)端為主,PC也可以支持。
初步界面設(shè)計(jì)如下:

2.gradio前端布局
import numpy as np
import gradio as gr
import os
from fastapi import FastAPI
import requests
import json
import jieba
with gr.Blocks(title="aiweker") as wekerapp:
gr.Markdown("## 微客翻譯")
with gr.Row():
translate_output = gr.Textbox(
label="結(jié)果在這里",
lines=10
)
with gr.Row():
translate_txt = gr.Textbox(show_label=False, placeholder="輸入你要的單詞,中文或者英文").style(container=False)
with gr.Row():
with gr.Column(scale=1):
translate_button = gr.Button("提交")gradio提供的產(chǎn)品說(shuō)明設(shè)計(jì)中的組件,包括文本框(Textbox)和 按鈕(Button)。由于優(yōu)先支持手機(jī)端顯式,布局上一行布局為主,一行一個(gè)組件。
3.翻譯器實(shí)現(xiàn)
如何實(shí)現(xiàn)翻譯功能,可以訪問(wèn)百度翻譯功能,間接實(shí)現(xiàn)翻譯功能。通過(guò)分析可以通過(guò)https://fanyi.baidu.com/sug可以實(shí)現(xiàn)翻譯功能。接口返回多個(gè)key-value鍵值對(duì)
def translate(input_text):
url = "https://fanyi.baidu.com/sug"
headers = {"User-Agent":"Mozilla/5.0 (Windows NT 10.0; Win64; x64)"}
data = {"kw": input_text}
rsp = requests.post(url=url, headers=headers, data=data)
data = json.loads(rsp.content.decode())
return data
???????# {'errno': 0, 'data': [{'k': '清華大學(xué)', 'v': '名. Tsinghua University'}]}4.gradio功能調(diào)用
為了說(shuō)明每一個(gè)單詞的解釋,我們接入中文分詞jieba進(jìn)行分詞。
def translate_process(input_text):
result = []
if len(input_text)< 3:
seg_list = [input_text]
else:
seg_list = jieba.cut(input_text, cut_all=False)
for text in seg_list:
data = translate(text)
for ds in data.get('data', []):
result.append("{}: {}".format(ds.get('k'),ds.get('v')))
break
return "\n".join(result)
???????translate_button.click(translate_process, inputs=translate_txt, outputs=translate_output)click將實(shí)現(xiàn)按鈕的點(diǎn)擊事件,輸入前端中的text,輸出結(jié)果也是text組件,處理過(guò)程為translate_process,每個(gè)分詞的解釋。
執(zhí)行python文件就可以部署了。
python -u app.py
5.總結(jié)和下一步
這里分享一個(gè)簡(jiǎn)單的app應(yīng)用開(kāi)發(fā),從產(chǎn)品設(shè)計(jì)、代碼開(kāi)發(fā)到部署。當(dāng)然這只是一個(gè)簡(jiǎn)單的demo,再做產(chǎn)品時(shí)出來(lái)實(shí)現(xiàn)功能外,還要考慮市場(chǎng)因素,你可以實(shí)現(xiàn)一個(gè)功能,但是市場(chǎng)已經(jīng)有類似的產(chǎn)品,你的產(chǎn)品有什么獨(dú)特性,有沒(méi)有解決別人沒(méi)有解決的問(wèn)題。
下一步計(jì)劃:
- 部署上的優(yōu)化,多進(jìn)程部署
- 增加輸入圖片翻譯功能,可以通過(guò)手機(jī)拍攝,返回翻譯結(jié)果
二、用Python做一個(gè)翻譯器進(jìn)階篇
1. 多進(jìn)程部署
我們知道,python的多線程實(shí)現(xiàn)其實(shí)不能很好的發(fā)揮多CPU的計(jì)算能力,如果有多核CPU的話建議采用多進(jìn)程部署。對(duì)于python程序可以有很多種方式來(lái)多進(jìn)程部署,如multiprocessing,Ray,Mars等。而對(duì)于web app部署用的gunicore+uvicore,負(fù)載均衡還會(huì)加上nginx。
Gunicorn (Green Unicorn)是一個(gè)基于Python的WSGI(Web Server Gateway Interface) HTTP服務(wù)器,它是一個(gè)開(kāi)源的工具,在大量的Python Web應(yīng)用中被廣泛使用,例如 Django、Flask等。在Gunicorn中,使用worker來(lái)處理客戶端的請(qǐng)求,可以根據(jù)配置啟動(dòng)多個(gè)worker用來(lái)處理請(qǐng)求,同時(shí)也支持在同一端口上使用多個(gè)worker。
Gunicorn可以使用多個(gè)進(jìn)程在多個(gè)CPU上同時(shí)運(yùn)行,提高Web應(yīng)用的并發(fā)能力。它具有以下特點(diǎn):
1.高可靠性:Gunicorn使用多進(jìn)程方式運(yùn)行,任何一個(gè)進(jìn)程出現(xiàn)問(wèn)題都不會(huì)影響整個(gè)應(yīng)用的運(yùn)行,進(jìn)程間異常自動(dòng)重啟。
2.高性能:Gunicorn使用高效的異步I/O機(jī)制,能夠處理高并發(fā)請(qǐng)求。
3.易于部署:Gunicorn可以通過(guò)命令行簡(jiǎn)單地啟動(dòng)應(yīng)用程序,也可以與Nginx等Web服務(wù)器配合使用。
4.高安全性:Gunicorn支持SSL/TLS加密傳輸,可對(duì)數(shù)據(jù)進(jìn)行加密保護(hù),保障數(shù)據(jù)的安全性。
與之相比,Uvicorn 是一個(gè)基于 ASGI(Asynchronous Server Gateway Interface) 的 Web 服務(wù)器,它也是用 Python 編寫的,主要的特點(diǎn)是支持異步請(qǐng)求和響應(yīng)。Uvicorn 在處理高負(fù)載的 Web 應(yīng)用程序時(shí)表現(xiàn)出色,因?yàn)樗軌蚶?Python 異步編程模型來(lái)處理大量并發(fā)請(qǐng)求,在響應(yīng)速度和處理效率上都比 Gunicorn 要快。
通常的組合是Gunicorn+uvicore, 或者Gunicorn+greenlet(異步)
針對(duì)翻譯這個(gè)小app部署,gradio提供了將app嵌入到FastAPI中,而FastAPI可用gunicore+uvicore部署,具體如下:
# 文件名為translate.py
from fastapi import FastAPI
import gradio as gr
app = FastAPI()
with gr.Blocks() as demo:
pass
app = gr.mount_gradio_app(app, demo, path="/translate")
# gunicorn translate:app -w 4 -k uvicorn.workers.UvicornWorker
上面的例子為啟動(dòng)4個(gè)進(jìn)程,接受外部請(qǐng)求。
2. 添加圖片識(shí)別功能
為了增加翻譯功能的使用場(chǎng)景,增加了一個(gè)上傳或者拍照識(shí)別的功能,以區(qū)別其他的產(chǎn)品。
實(shí)現(xiàn)這個(gè)功能需要:
- 增加一個(gè)上傳圖片的前端界面
- 圖片ocr識(shí)別功能
同樣的,上傳圖片的前端界面采用gradio來(lái)編寫,如下:
with gr.Blocks(title="aiweker") as wekerapp:
gr.Markdown("## 微客翻譯")
with gr.Row():
translate_output = gr.Textbox(
label="結(jié)果在這里",
lines=10
)
with gr.Row():
translate_txt = gr.Textbox(show_label=False, placeholder="輸入你要的單詞,文或者英文").style(container=False)
with gr.Row():
with gr.Column(scale=1):
translate_button = gr.Button("提交")
with gr.Row():
with gr.Accordion("點(diǎn)這里提交圖片翻譯", open=False):
translate_image_input = gr.Image()
translate_image = gr.Button("提交圖片")
translate_button.click(translate_process, inputs=translate_txt, outputs=translate_output)
translate_image.click(ocr_process, inputs=translate_image_input, outputs=translate_output)其中:
translate_image是圖片提交按鈕,click事件的輸入為圖片,輸出為翻譯后的文本(即對(duì)應(yīng)ocr_process輸入?yún)?shù)和輸出參數(shù))
而OCR圖片識(shí)別,采用開(kāi)源OCR paddleocr。安裝和使用參見(jiàn):
https://github.com/PaddlePaddle/PaddleOCR
需要注意的為了提供識(shí)別性能,上傳的圖片需要resize到一個(gè)比較小的尺寸如320。
到此這篇關(guān)于使用Python制作一個(gè)翻譯器的文章就介紹到這了,更多相關(guān)Python翻譯器內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
Python?遞歸式實(shí)現(xiàn)二叉樹(shù)前序,中序,后序遍歷
這篇文章主要介紹了Python?遞歸式實(shí)現(xiàn)二叉樹(shù)前序,中序,后序遍歷,更多相關(guān)資料,需要的小伙伴可以參考下面具體的文章內(nèi)容2022-03-03
python基于moviepy實(shí)現(xiàn)音視頻剪輯
為了方便學(xué)習(xí)和復(fù)習(xí),需要把一些長(zhǎng)音視頻剪成一些小片段。本文介紹如何用Python實(shí)現(xiàn),把音視頻中的某一些片段剪出來(lái)。2021-06-06
Python實(shí)現(xiàn)詞云圖詞頻統(tǒng)計(jì)
這篇文章主要為大家詳細(xì)介紹了Python數(shù)據(jù)分析中的詞頻統(tǒng)計(jì)和詞云圖可視化,文中的示例代碼講解詳細(xì),對(duì)我們學(xué)習(xí)Python有一定的幫助,需要的可以參考一下2022-12-12
Python可變參數(shù)會(huì)自動(dòng)填充前面的默認(rèn)同名參數(shù)實(shí)例
今天小編就為大家分享一篇Python可變參數(shù)會(huì)自動(dòng)填充前面的默認(rèn)同名參數(shù)實(shí)例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧2019-11-11
Python實(shí)現(xiàn)斐波那契數(shù)列的示例代碼
斐波那契數(shù)列是一種經(jīng)典的數(shù)學(xué)問(wèn)題,在計(jì)算機(jī)科學(xué)和編程中經(jīng)常被用來(lái)演示算法和遞歸的概念,本文將詳細(xì)介紹斐波那契數(shù)列的定義、計(jì)算方法以及如何在Python中實(shí)現(xiàn)它,需要的可以參考下2024-01-01
Python中解決浮點(diǎn)數(shù)精度問(wèn)題的常見(jiàn)方法
在Python中,浮點(diǎn)數(shù)是以雙精度(64位)存儲(chǔ)的,這種表示方式雖然能夠表示非常廣泛的數(shù)值范圍,但并不能精確表示所有的小數(shù),下面我們來(lái)看看Python是如何解決浮點(diǎn)數(shù)精度問(wèn)題的吧2025-08-08
django中的auth模塊與admin后臺(tái)管理方法
這篇文章主要介紹了django中的auth模塊與admin后臺(tái)管理方法,包括auth模塊的常用方法及如何擴(kuò)展auth_user表,本文通過(guò)實(shí)例代碼給大家介紹的非常詳細(xì),需要的朋友可以參考下2022-09-09
基于opencv的selenium滑動(dòng)驗(yàn)證碼的實(shí)現(xiàn)
這篇文章主要介紹了基于opencv的selenium滑動(dòng)驗(yàn)證碼的實(shí)現(xiàn),文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來(lái)一起學(xué)習(xí)學(xué)習(xí)吧2020-07-07
使用Python和Tesseract實(shí)現(xiàn)驗(yàn)證碼識(shí)別功能
驗(yàn)證碼識(shí)別是一個(gè)常見(jiàn)且實(shí)用的技術(shù)需求,尤其是在自動(dòng)化測(cè)試和數(shù)據(jù)采集場(chǎng)景中,通過(guò)開(kāi)源 OCR工具 Tesseract,結(jié)合 Python 的強(qiáng)大生態(tài),我們可以高效實(shí)現(xiàn)驗(yàn)證碼識(shí)別任務(wù),本篇博客將以詳細(xì)步驟和代碼示例,介紹如何使用 Python 和 Tesseract 實(shí)現(xiàn)驗(yàn)證碼識(shí)別2025-01-01

