Python 制作自动化翻译工具


Posted in Python onApril 25, 2021

妈妈再也不用担心我的英语了。

一个可能你似曾相识的场景

阅读内容包含大量英文的 PPT、Word、Excel 或者记事本时,由于英语不熟悉,为了流利地阅读,需要打开浏览器进入谷歌翻译的主界面,然后把英文复制到谷歌翻译的输入框中,最后又把翻译结果复制回 PPT、Word 和 Excel。

Python 制作自动化翻译工具

Python 制作自动化翻译工具

要是一个两个单词还好,要是发现有 100 个单词不认识,就必须复制粘贴 200 次,如此机械性重复性的工作,应该交给程序来做,这就是我设计下面这个自动化翻译工具的初衷。

提升办公效率的法宝

Python 制作自动化翻译工具

如上图,运行程序并保持后台运行,在电脑上的任何一个软件中选择一段文本,并 Ctrl + C 复制到系统剪贴板中,程序就会自动帮助我们完成翻译,并将翻译结果自动复制到系统剪贴版中,只需 Ctrl + V,就完成了翻译结果对原文的替换。

编码实现

程序主要分为两部分,第一部分为谷歌翻译爬虫,第二部分就是实现这个将翻译结果自动替换的业务逻辑。

谷歌翻译爬虫

通过浏览器 F12 开发者工具,很容易定位到翻译请求的 URL: http://translate.google.cn/translate_a/single?client=t&sl=en&tl=zh-CN&hl=zh-CN&dt=at&dt=bd&dt=ex&dt=ld&dt=md&dt=qca&dt=rw&dt=rm&dt=ss &dt=t&ie=UTF-8&oe=UTF-8&clearbtn=1&otf=1&pc=1&srcrom=0&ssel=0&tsel=0&kc=2

这个请求接受两个参数,一个就是我们要翻译的字符串 q,另一个是用于用户认证的 tk(token),其中 q 很容易构造,tk 的构造就需要花费一番心力了,需要我们调试 js 代码,这里参考 Github 上大神的轮子: https://github.com/cocoa520/Google_TK

谷歌翻译爬虫的主要代码如下:

def translate(tk, content):
    if len(content) > 4891:
        print("翻译的长度超过限制!!!")
        return

    param = {'tk': tk, 'q': content}

    result = requests.get("""http://translate.google.cn/translate_a/single?client=t&sl=en
        &tl=zh-CN&hl=zh-CN&dt=at&dt=bd&dt=ex&dt=ld&dt=md&dt=qca&dt=rw&dt=rm&dt=ss
        &dt=t&ie=UTF-8&oe=UTF-8&clearbtn=1&otf=1&pc=1&srcrom=0&ssel=0&tsel=0&kc=2""", params=param)

    data = result.json()
    print(data[0][0][0])

返回结果是 json 形式的,翻译结果保存在结果的第一个元组中。

Python 操作系统剪贴板

将读取剪贴板的内容的代码封装成函数如下:

def getText():#读取剪切板
    # 打开剪贴板
    w.OpenClipboard()
    # 读取剪贴板的内容
    d = w.GetClipboardData(win32con.CF_TEXT)
    # 关闭剪贴板
    w.CloseClipboard()
    try:
        return d.decode('utf-8')
    except:
        return d.decode('gbk')

返回值 d 是字节类型的,需要解码,中文按 gbk 格式解码,英文按 utf-8 解码。

类似地,写入剪贴板的代码如下:

def setText(aString):#写入剪切板
    # 打开剪贴板
    w.OpenClipboard()
    # 清空剪贴板
    w.EmptyClipboard()
    # 写入剪贴板
    w.SetClipboardText(aString)
    # 关闭剪贴板
    w.CloseClipboard()

实现将翻译结果自动替换原文的逻辑的代码如下:

while(True):
        # 如果剪贴板正在被占用
        try:
            cs = getText()
        except:
            time.sleep(1)
            cs = getText()
        print('cs',cs)
        if cs and cs != ls:
            print('准备翻译')
            content = getText()
            tk = js.getTk(content)
            res = translate(tk, content)
            setText(res)
            time.sleep(1)
            ls = res

值得注意的是,系统剪贴板对象是单例模式的,在操作系统范围内只有一个,而且读写剪贴板都是互斥的,在读(写)剪贴板的同时不允许任何对剪贴板的写(读)操作。试想这样一种情景,我们在其他软件中 Ctrl + C 写入剪贴板,而此时我们的程序代码正好执行到读剪贴板那一行,毫无疑问会报错,我的解决办法是使用 try…except 语句延时 1 s再读取,这样可以大大降低读写碰撞的概率,但无疑消耗了程序性能。最好的办法是判断剪贴板对象句柄是否被占用,其实我一直在寻找是否存在判断剪贴板对象句柄是否被占用的 API,但是一直没有找到

项目地址

https://github.com/Python3Spiders/GoogleAutoTranslationTool

以上就是Python 实现自动化翻译和替换的脚本的详细内容,更多关于python 自动化翻译的资料请关注三水点靠木其它相关文章!

Python 相关文章推荐
python读取html中指定元素生成excle文件示例
Apr 03 Python
分析在Python中何种情况下需要使用断言
Apr 01 Python
Python psutil模块简单使用实例
Apr 28 Python
python中enumerate函数遍历元素用法分析
Mar 11 Python
python使用Apriori算法进行关联性解析
Dec 21 Python
Python用csv写入文件_消除空余行的方法
Jul 06 Python
Ubuntu下Anaconda和Pycharm配置方法详解
Jun 14 Python
对PyQt5的输入对话框使用(QInputDialog)详解
Jun 25 Python
python对csv文件追加写入列的方法
Aug 01 Python
python-sys.stdout作为默认函数参数的实现
Feb 21 Python
如何利用python和DOS获取wifi密码
Mar 31 Python
django 认证类配置实现
Nov 11 Python
教你用Python写一个植物大战僵尸小游戏
python爬取新闻门户网站的示例
Apr 25 #Python
python自然语言处理之字典树知识总结
Python自然语言处理之切分算法详解
Apr 25 #Python
Python网络编程之ZeroMQ知识总结
Python 文本滚动播放器的实现代码
Apr 25 #Python
Python基于Opencv识别两张相似图片
You might like
最简单的PHP程序--记数器
2006/10/09 PHP
笑谈配置,使用Smarty技术
2007/01/04 PHP
第4章 数据处理-php字符串的处理-郑阿奇(续)
2011/07/04 PHP
PHP制作万年历
2015/01/07 PHP
Smarty中的注释和截断功能介绍
2015/04/09 PHP
PHP7新增运算符用法实例分析
2016/09/26 PHP
php获取今日开始时间和结束时间的方法
2017/02/27 PHP
yii框架结合charjs统计上一年与当前年数据的方法示例
2020/04/04 PHP
从零开始学习jQuery (十) jQueryUI常用功能实战
2011/02/23 Javascript
jquery attr 设定src中含有&(宏)符号问题的解决方法
2011/07/26 Javascript
jquery图片放大镜功能的实例代码
2013/03/26 Javascript
nodejs实现bigpipe异步加载页面方案
2016/01/26 NodeJs
去除html代码里面的script正则方法
2016/05/19 Javascript
jQuery使用serialize()表单序列化时出现中文乱码问题的解决办法
2016/07/27 Javascript
详解Node.js access_token的获取、存储及更新
2017/06/20 Javascript
Vue.js 中的 v-show 指令及用法详解
2018/11/19 Javascript
JS尾递归的实现方法及代码优化技巧
2019/01/19 Javascript
详解easyui 切换主题皮肤
2019/04/04 Javascript
Vue 引入AMap高德地图的实现代码
2019/04/29 Javascript
关于在LayUI中使用AJAX提交巨坑记录
2019/10/25 Javascript
JavaScript实现打砖块游戏
2020/02/25 Javascript
Python中的is和id用法分析
2015/01/26 Python
在Ubuntu系统下安装使用Python的GUI工具wxPython
2016/02/18 Python
python如何通过实例方法名字调用方法
2018/03/21 Python
解决python线程卡死的问题
2019/02/18 Python
python使用 cx_Oracle 模块进行查询操作示例
2019/11/28 Python
Tensorflow设置显存自适应,显存比例的操作
2020/02/03 Python
python Paramiko使用示例
2020/09/21 Python
css 如何让背景图片拉伸填充避免重复显示
2013/07/11 HTML / CSS
Unix/Linux开发面试题
2016/08/16 面试题
爱岗敬业演讲稿
2014/05/05 职场文书
国际商务专业毕业生自我鉴定2014
2014/09/27 职场文书
党委工作总结2015
2015/04/27 职场文书
幼儿园六一主持词
2015/06/30 职场文书
六五普法学习心得体会
2016/01/21 职场文书
2019财务毕业实习报告
2019/06/27 职场文书