PPT到PDF转换器:一个功能强大的Python GUI应用(unzip,convert,replace,merge)

本文主要是介绍PPT到PDF转换器:一个功能强大的Python GUI应用(unzip,convert,replace,merge),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

在当今的数字时代,文档格式转换已成为一项常见需求。特别是将PowerPoint演示文稿转换为PDF格式,这不仅可以确保文档的一致性,还能方便分享和打印。今天,我们将深入探讨一个使用Python开发的强大GUI应用程序,它不仅可以将PPT转换为PDF,还具备文本替换、PDF处理和文件合并等多项功能。
C:\pythoncode\new\unzipconvertpdfmerge.py

应用概述

这个应用程序主要完成以下任务:

  1. 解压7z压缩文件
  2. 在PPT文件中替换指定文本
  3. 将PPT文件转换为PDF
  4. 处理生成的PDF文件(删除最后一页,更新公司名称)
  5. 合并所有PDF文件

让我们逐步解析这个应用的核心组件和功能。

全部代码

import os
import wx
import fitz  # PyMuPDF
import py7zr
from pptx import Presentation
from pptx.enum.shapes import MSO_SHAPE_TYPE
from PyPDF2 import PdfMerger
import comtypes.client
import pythoncomclass MyFrame(wx.Frame):def __init__(self):wx.Frame.__init__(self, None, title="PPT to PDF Converter", size=(500, 300))panel = wx.Panel(self)vbox = wx.BoxSizer(wx.VERTICAL)self.dir_picker = wx.DirPickerCtrl(panel, message="Choose a destination folder")vbox.Add(self.dir_picker, flag=wx.EXPAND | wx.ALL, border=10)self.input_box1 = wx.TextCtrl(panel, value="Enter text to replace")vbox.Add(self.input_box1, flag=wx.EXPAND | wx.ALL, border=10)self.input_box2 = wx.TextCtrl(panel, value="Enter replacement text")vbox.Add(self.input_box2, flag=wx.EXPAND | wx.ALL, border=10)self.unzip_button = wx.Button(panel, label="Unzip and Convert")vbox.Add(self.unzip_button, flag=wx.EXPAND | wx.ALL, border=10)self.unzip_button.Bind(wx.EVT_BUTTON, self.on_unzip_convert)panel.SetSizer(vbox)def on_unzip_convert(self, event):destination_dir = self.dir_picker.GetPath()text_to_replace = self.input_box1.GetValue()replacement_text = self.input_box2.GetValue()with wx.FileDialog(self, "Choose a 7z file", wildcard="7z files (*.7z)|*.7z", style=wx.FD_OPEN) as fileDialog:if fileDialog.ShowModal() == wx.ID_CANCEL:returnzip_path = fileDialog.GetPath()# Step 1: Unzip the 7z filewith py7zr.SevenZipFile(zip_path, mode='r') as archive:archive.extractall(path=destination_dir)# Step 2: Process all PPT filespdf_files = []for root, dirs, files in os.walk(destination_dir):for file in files:if file.endswith('.pptx'):ppt_path = os.path.join(root, file)pdf_path = os.path.splitext(ppt_path)[0] + ".pdf"# Replace text in PPTself.replace_text_in_ppt(ppt_path, text_to_replace, replacement_text)# Convert PPT to PDFself.convert_ppt_to_pdf(ppt_path, pdf_path)# Process the PDF (remove last page, update company name)self.process_pdf(pdf_path, replacement_text)pdf_files.append(pdf_path)# Step 3: Merge all PDFsself.merge_pdfs(pdf_files, os.path.join(destination_dir, "merge.pdf"))wx.MessageBox("Process completed!", "Info", wx.OK | wx.ICON_INFORMATION)def replace_text_in_ppt(self, ppt_path, old_text, new_text):prs = Presentation(ppt_path)for slide in prs.slides:for shape in slide.shapes:if shape.shape_type == MSO_SHAPE_TYPE.TEXT_BOX:if shape.text_frame and old_text in shape.text:shape.text = shape.text.replace(old_text, new_text)prs.save(ppt_path)def convert_ppt_to_pdf(self, ppt_path, pdf_path):# Start PowerPoint applicationpowerpoint = comtypes.client.CreateObject("PowerPoint.Application")powerpoint.Visible = 1# Open the PowerPoint filepresentation = powerpoint.Presentations.Open(ppt_path)# Save as PDFpresentation.SaveAs(pdf_path, 32)  # 32 is the enum value for PDF formatpresentation.Close()# Quit PowerPoint applicationpowerpoint.Quit()def process_pdf(self, pdf_path, company_name):doc = fitz.open(pdf_path)# Remove the last pageif len(doc) > 1:doc.delete_page(len(doc) - 1)# Modify the first page's company namepage = doc[0]text_instances = page.search_for(company_name)if text_instances:for inst in text_instances:rect = inst.rectpage.insert_text((rect.x0, rect.y0), company_name, fontsize=12, color=(0, 0, 0))doc.saveIncr()  # Save changes to the same filedoc.close()def merge_pdfs(self, pdf_files, output_path):merger = PdfMerger()for pdf in pdf_files:merger.append(pdf)merger.write(output_path)merger.close()class MyApp(wx.App):def OnInit(self):frame = MyFrame()frame.Show()return Trueapp = MyApp()
app.MainLoop()

核心组件

1. 图形用户界面(GUI)

应用使用wxPython库创建了一个简单而功能强大的GUI。主要包含以下元素:

  • 目录选择器:用于选择输出目录
  • 两个文本输入框:分别用于输入要替换的文本和替换后的文本
  • "解压并转换"按钮:启动整个处理流程
class MyFrame(wx.Frame):def __init__(self):# ... (GUI 初始化代码)

2. 7z文件解压

使用py7zr库实现7z文件的解压:

with py7zr.SevenZipFile(zip_path, mode='r') as archive:archive.extractall(path=destination_dir)

3. PPT文本替换

利用python-pptx库在PPT文件中进行文本替换:

def replace_text_in_ppt(self, ppt_path, old_text, new_text):prs = Presentation(ppt_path)for slide in prs.slides:for shape in slide.shapes:if shape.shape_type == MSO_SHAPE_TYPE.TEXT_BOX:if shape.text_frame and old_text in shape.text:shape.text = shape.text.replace(old_text, new_text)prs.save(ppt_path)

4. PPT到PDF的转换

使用comtypes库调用PowerPoint应用程序进行转换:

def convert_ppt_to_pdf(self, ppt_path, pdf_path):powerpoint = comtypes.client.CreateObject("PowerPoint.Application")presentation = powerpoint.Presentations.Open(ppt_path)presentation.SaveAs(pdf_path, 32)  # 32 对应PDF格式presentation.Close()powerpoint.Quit()

5. PDF处理

使用PyMuPDF(fitz)库处理PDF文件:

def process_pdf(self, pdf_path, company_name):doc = fitz.open(pdf_path)if len(doc) > 1:doc.delete_page(len(doc) - 1)page = doc[0]text_instances = page.search_for(company_name)if text_instances:for inst in text_instances:rect = inst.rectpage.insert_text((rect.x0, rect.y0), company_name, fontsize=12, color=(0, 0, 0))doc.saveIncr()doc.close()

6. PDF合并

使用PyPDF2库合并多个PDF文件:

def merge_pdfs(self, pdf_files, output_path):merger = PdfMerger()for pdf in pdf_files:merger.append(pdf)merger.write(output_path)merger.close()

工作流程

  1. 用户选择7z文件和输出目录,输入要替换的文本。
  2. 点击"解压并转换"按钮后,程序解压7z文件。
  3. 遍历所有PPT文件,进行以下操作:
    • 替换指定文本
    • 转换为PDF
    • 处理生成的PDF(删除最后一页,更新公司名称)
  4. 最后,将所有处理过的PDF合并为一个文件。

技术亮点

  1. 多库协作: 利用多个Python库(wxPython, py7zr, python-pptx, comtypes, PyMuPDF, PyPDF2)协同工作,实现复杂功能。
  2. 自动化办公: 实现了从PPT文本替换到PDF转换和处理的全自动化流程。
  3. 用户友好: 提供了直观的GUI,使非技术用户也能轻松操作。
  4. 可扩展性: 模块化的设计使得添加新功能变得简单。

结果如下

在这里插入图片描述

总结

这个Python应用展示了如何将多个复杂的文档处理任务整合到一个用户友好的界面中。它不仅提高了工作效率,还为类似的文档处理任务提供了一个可扩展的框架。无论是对于日常办公还是大规模文档处理,这种自动化工具都能带来显著的效率提升。

这篇关于PPT到PDF转换器:一个功能强大的Python GUI应用(unzip,convert,replace,merge)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1112905

相关文章

Python中pywin32 常用窗口操作的实现

《Python中pywin32常用窗口操作的实现》本文主要介绍了Python中pywin32常用窗口操作的实现,pywin32主要的作用是供Python开发者快速调用WindowsAPI的一个... 目录获取窗口句柄获取最前端窗口句柄获取指定坐标处的窗口根据窗口的完整标题匹配获取句柄根据窗口的类别匹配获取句

利用Python打造一个Excel记账模板

《利用Python打造一个Excel记账模板》这篇文章主要为大家详细介绍了如何使用Python打造一个超实用的Excel记账模板,可以帮助大家高效管理财务,迈向财富自由之路,感兴趣的小伙伴快跟随小编一... 目录设置预算百分比超支标红预警记账模板功能介绍基础记账预算管理可视化分析摸鱼时间理财法碎片时间利用财

Python中的Walrus运算符分析示例详解

《Python中的Walrus运算符分析示例详解》Python中的Walrus运算符(:=)是Python3.8引入的一个新特性,允许在表达式中同时赋值和返回值,它的核心作用是减少重复计算,提升代码简... 目录1. 在循环中避免重复计算2. 在条件判断中同时赋值变量3. 在列表推导式或字典推导式中简化逻辑

python处理带有时区的日期和时间数据

《python处理带有时区的日期和时间数据》这篇文章主要为大家详细介绍了如何在Python中使用pytz库处理时区信息,包括获取当前UTC时间,转换为特定时区等,有需要的小伙伴可以参考一下... 目录时区基本信息python datetime使用timezonepandas处理时区数据知识延展时区基本信息

Python位移操作和位运算的实现示例

《Python位移操作和位运算的实现示例》本文主要介绍了Python位移操作和位运算的实现示例,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录1. 位移操作1.1 左移操作 (<<)1.2 右移操作 (>>)注意事项:2. 位运算2.1

使用Python和Pyecharts创建交互式地图

《使用Python和Pyecharts创建交互式地图》在数据可视化领域,创建交互式地图是一种强大的方式,可以使受众能够以引人入胜且信息丰富的方式探索地理数据,下面我们看看如何使用Python和Pyec... 目录简介Pyecharts 简介创建上海地图代码说明运行结果总结简介在数据可视化领域,创建交互式地

利用python实现对excel文件进行加密

《利用python实现对excel文件进行加密》由于文件内容的私密性,需要对Excel文件进行加密,保护文件以免给第三方看到,本文将以Python语言为例,和大家讲讲如何对Excel文件进行加密,感兴... 目录前言方法一:使用pywin32库(仅限Windows)方法二:使用msoffcrypto-too

使用Python实现矢量路径的压缩、解压与可视化

《使用Python实现矢量路径的压缩、解压与可视化》在图形设计和Web开发中,矢量路径数据的高效存储与传输至关重要,本文将通过一个Python示例,展示如何将复杂的矢量路径命令序列压缩为JSON格式,... 目录引言核心功能概述1. 路径命令解析2. 路径数据压缩3. 路径数据解压4. 可视化代码实现详解1

python获取网页表格的多种方法汇总

《python获取网页表格的多种方法汇总》我们在网页上看到很多的表格,如果要获取里面的数据或者转化成其他格式,就需要将表格获取下来并进行整理,在Python中,获取网页表格的方法有多种,下面就跟随小编... 目录1. 使用Pandas的read_html2. 使用BeautifulSoup和pandas3.

Python装饰器之类装饰器详解

《Python装饰器之类装饰器详解》本文将详细介绍Python中类装饰器的概念、使用方法以及应用场景,并通过一个综合详细的例子展示如何使用类装饰器,希望对大家有所帮助,如有错误或未考虑完全的地方,望不... 目录1. 引言2. 装饰器的基本概念2.1. 函数装饰器复习2.2 类装饰器的定义和使用3. 类装饰