python实现word转anki制卡格式

2023-12-28 04:30

本文主要是介绍python实现word转anki制卡格式,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录阿

    • 超级长的吐槽前言
    • 目标简述
    • 第一歩:将段落格式转换为英文和汉字分开并且以tab制表符分开
    • 第二步:使用有道翻译url带入短语参数获取例句信息
    • 第三步:导入anki

超级长的吐槽前言

最近需要背一下短语,没有在各大背单词app上面找到我需要背的词书.没办法了,去网上找到了某垃圾教育网站的word,…,这个格式,简直惨不忍睹,???那个憨憨做的文档??分栏不会吗居然手打空格来分栏,我佛了np,来感受一下
在这里插入图片描述

好吧,我承认光是把格式改成一条词汇一行我就花了半个小时…
在这里插入图片描述

目标简述

首先需要将上一张图片的格式转换为英文和汉字分开并且以tab制表符分开,(在anki导入卡片的时候使用制表符分割字段)
在这里插入图片描述
然后还需要给短语加上例句,变成这样
在这里插入图片描述
最后进行导入操作,得到
在这里插入图片描述

第一歩:将段落格式转换为英文和汉字分开并且以tab制表符分开

import re
# 
# 用于anki卡片txt制作,简单实现对英文和中文的分割,分隔符为\t
# python 3.5版本
# 正则匹配中文,固定形式:\u4E00-\u9FA5
# 
with open("1.txt","r") as tt: #1.txt为目标文档for i in tt.readlines():text = iregex_str = ".*?([\u4E00-\u9FA5|\W]+).*?" #构造pattench = re.findall(regex_str, text) #读取所有中文en = re.findall('[a-zA-Z0-9]+',text) #读取所有英文if ch:#如果读取到了中文rc="" #初始化中文翻译结果变量Re="" #初始化短语结果变量for j in ch:rc=rc+j#组装中文结果if en:#如果读取到了英文for k in en:Re=Re+k+" "#组装短语结果,单词与单词之间还需要加一个空格print(Re)with open("2.txt","a") as tt2:tt2.write(Re+"\t"+rc)#写入结果(追加)

第二步:使用有道翻译url带入短语参数获取例句信息

这里用到了requests库用于发送翻译请求,BeautifulSoup库用于读取指定内容,html库用于去除所有的html标记(太方便了这个库)
这里主要是在上一步的"判断如果读取到了英文"后面加入内容

import re,requests
from bs4 import BeautifulSoup
from w3lib import html
# 
# 用于anki卡片txt制作,简单实现对英文和中文的分割,分隔符为\t
# python 3.5版本
# 正则匹配中文,固定形式:\u4E00-\u9FA5
# 
with open("1.txt","r") as tt:for i in tt.readlines():text = iregex_str = ".*?([\u4E00-\u9FA5|\W]+).*?"ch = re.findall(regex_str, text)en = re.findall('[a-zA-Z0-9]+',text)if ch:rc=""Re=""for j in ch:rc=rc+jif en:for k in en:Re=Re+k+" "print(Re)url="http://dict.youdao.com/w/eng/"+Re#构造翻译请求链接Rs=requests.get(url)#发送链接Rs=BeautifulSoup(Rs.text,'html.parser')#指定解析方式为htmlif Rs.select('.examples'):#先判断有没有提供柯林斯英汉双解大词典例句 注释1Rs=Rs.select('.examples') #注释2else:#如果没有就找普通例句Rs=Rs.select('#bilingual')#注释2Rs= str(html.remove_tags(str(Rs)))#去掉所有html代码Rs = Rs.replace("《柯林斯英汉双解大词典》","").replace("《牛津词典》","").replace("\n","").replace("更多双语例句","").replace("精选例句","")#去掉不必要的信息with open("2.txt","a") as tt2:tt2.write(Re+"\t"+rc.replace("\n","")+str(Rs)+"\n")#写入数据并且英文与答案之间以tab隔开
  • 注释1:随便翻译一个词汇发现结果界面会有2个地方出现例句,第一个是柯林斯英汉双解大词典例句,第二个是其他大辞典里面的例句.不过有些词汇的翻译并没有柯林斯英汉双解大词典例句.
    在这里插入图片描述
    查看网页源代码发现柯林斯英汉双解大词典例句的class=examples.
    在这里插入图片描述

  • 注释2:仔细观察后发现普通例句的id为bilingual
    在这里插入图片描述

第三步:导入anki

如下即可
在这里插入图片描述

尾巴:还是想吐槽一下,为什么这些教育网站都那么垃圾阿,界面也low,都几十年前的风格了吧,还卡…

这篇关于python实现word转anki制卡格式的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/545064

相关文章

使用Python和OpenCV库实现实时颜色识别系统

《使用Python和OpenCV库实现实时颜色识别系统》:本文主要介绍使用Python和OpenCV库实现的实时颜色识别系统,这个系统能够通过摄像头捕捉视频流,并在视频中指定区域内识别主要颜色(红... 目录一、引言二、系统概述三、代码解析1. 导入库2. 颜色识别函数3. 主程序循环四、HSV色彩空间详解

一文深入详解Python的secrets模块

《一文深入详解Python的secrets模块》在构建涉及用户身份认证、权限管理、加密通信等系统时,开发者最不能忽视的一个问题就是“安全性”,Python在3.6版本中引入了专门面向安全用途的secr... 目录引言一、背景与动机:为什么需要 secrets 模块?二、secrets 模块的核心功能1. 基

PostgreSQL中MVCC 机制的实现

《PostgreSQL中MVCC机制的实现》本文主要介绍了PostgreSQL中MVCC机制的实现,通过多版本数据存储、快照隔离和事务ID管理实现高并发读写,具有一定的参考价值,感兴趣的可以了解一下... 目录一 MVCC 基本原理python1.1 MVCC 核心概念1.2 与传统锁机制对比二 Postg

SpringBoot整合Flowable实现工作流的详细流程

《SpringBoot整合Flowable实现工作流的详细流程》Flowable是一个使用Java编写的轻量级业务流程引擎,Flowable流程引擎可用于部署BPMN2.0流程定义,创建这些流程定义的... 目录1、流程引擎介绍2、创建项目3、画流程图4、开发接口4.1 Java 类梳理4.2 查看流程图4

python常见环境管理工具超全解析

《python常见环境管理工具超全解析》在Python开发中,管理多个项目及其依赖项通常是一个挑战,下面:本文主要介绍python常见环境管理工具的相关资料,文中通过代码介绍的非常详细,需要的朋友... 目录1. conda2. pip3. uvuv 工具自动创建和管理环境的特点4. setup.py5.

C++中零拷贝的多种实现方式

《C++中零拷贝的多种实现方式》本文主要介绍了C++中零拷贝的实现示例,旨在在减少数据在内存中的不必要复制,从而提高程序性能、降低内存使用并减少CPU消耗,零拷贝技术通过多种方式实现,下面就来了解一下... 目录一、C++中零拷贝技术的核心概念二、std::string_view 简介三、std::stri

Python常用命令提示符使用方法详解

《Python常用命令提示符使用方法详解》在学习python的过程中,我们需要用到命令提示符(CMD)进行环境的配置,:本文主要介绍Python常用命令提示符使用方法的相关资料,文中通过代码介绍的... 目录一、python环境基础命令【Windows】1、检查Python是否安装2、 查看Python的安

C++高效内存池实现减少动态分配开销的解决方案

《C++高效内存池实现减少动态分配开销的解决方案》C++动态内存分配存在系统调用开销、碎片化和锁竞争等性能问题,内存池通过预分配、分块管理和缓存复用解决这些问题,下面就来了解一下... 目录一、C++内存分配的性能挑战二、内存池技术的核心原理三、主流内存池实现:TCMalloc与Jemalloc1. TCM

OpenCV实现实时颜色检测的示例

《OpenCV实现实时颜色检测的示例》本文主要介绍了OpenCV实现实时颜色检测的示例,通过HSV色彩空间转换和色调范围判断实现红黄绿蓝颜色检测,包含视频捕捉、区域标记、颜色分析等功能,具有一定的参考... 目录一、引言二、系统概述三、代码解析1. 导入库2. 颜色识别函数3. 主程序循环四、HSV色彩空间

Python UV安装、升级、卸载详细步骤记录

《PythonUV安装、升级、卸载详细步骤记录》:本文主要介绍PythonUV安装、升级、卸载的详细步骤,uv是Astral推出的下一代Python包与项目管理器,主打单一可执行文件、极致性能... 目录安装检查升级设置自动补全卸载UV 命令总结 官方文档详见:https://docs.astral.sh/