python-docx 实现 Word 办公自动化

2024-08-21 00:52

本文主要是介绍python-docx 实现 Word 办公自动化,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

前言:当我们需要批量生成一些合同文件或者简历等。如果手工处理对于我们来说不仅工作量巨大,而且难免会出现一些问题。这个时候运用python处理word实现自动生成文件可极大的提高工作效率。

python-docx是python的第三方插件,用来处理word文件,自动化生成和修改word文档。下面我们一起探讨一下如何工作的:

目录

一、安装

二、新建文档对象

三、写入内容

3.1插入文本

3.2添加图片和表格

3.3样式处理

四、保存文档

五、Word转换PDF

1.单个文件的转换

 2.多个文件转换

六、总结 


一、安装

1.下载安装

使用之前需要先下载安装。命令行:pip install python-docx

pip install python-docx

2.导入模块

import docx

一个简单的word创建过程:1.创建一个文件对象 2.添加内容 3.保存文件 

下面是一个生成word文件的简单步骤:

# 导入python-docx模块
import docx
from docx import Document#1.新建文档对象
document = Document() # 创建一个空的文档对象
#Document("storeinfo.docx") #读取现有的word 建立文档对象
#2.添加内容
document.add_heading("销售门店新增通知")
#3.保存文档
document.save("shop.docx")

 文件运行之后可以看到生成一个shop.docx文件。

 

可以看到非常简单只有一个文件标题的word文件。下面我们对详细用法进一步探索。

二、新建文档对象

在这里我们直接打开用刚刚生成的word文件来修改。

#1.新建文档对象
document = Document("shop.docx") #读取现有的word 建立文档对象

三、写入内容

前面我们添加的题目没有进行设置,所以默认使用一级标题显示,现在我们对添加的内容进行设置。

3.1插入文本

插入文本包括标题,段落,可以对标题进行等级设置,段落进行段落首行以及左右缩进,段落的行间距、文本的字体大小颜色字号设置,加粗、斜体、下划线常用的设置。

1)设置标题等级,首行以及左右缩进,行间距。

#2.添加内容
document.add_heading("销售门店新增通知",level=3)  #设置标题是4级标题
# 插入段落
p1 = document.add_paragraph("针对市场情况有变,现在某某地区新增某某门店,请知悉。")
p1.insert_paragraph_before("补充通知:这是在刚刚的段落之前插入新的段落哦")# 段落可以设置段落属性和段落中文字属性
format = p1.paragraph_format
format.left_indent = Pt(20) #段落左侧的缩进
format.right_indent = Pt(20) # 段落右侧的缩进
format.first_line_indent = Pt(20) #首行缩进设置20镑# 行间距
format.line_spacing = 1.5 

 

2) 字体、字号、颜色设置 

记得先导入 from docx.shared import Pt,RGBColor。

# 使用段落和颜色设置需要用到
from docx.shared import Pt,RGBColor# p1 追加文本并对本文进行字体大小设置
run = p1.add_run("具体信息请咨询总部具体信息请咨询总部具体信息请咨询总部具体信息请咨询总部具体信息请咨询总部具体信息请咨询总部具体信息请咨询总部")
# 设置字体字号以及颜色
run.font.size = Pt(12) 
run.font.name = '微软雅黑'
run.font.color.rgb = RGBColor(225,25,25)

字号和大小对比图 如下:

3)字体加粗下划线斜体设置

# 字体加粗下划线 斜体
run1 = p1.add_run("这里是段落继续增加的文字信息")
run1.bold = True
run1.font.underline = True
run1.font.italic = True

  

 

3.2添加图片和表格
#插入图片
document.add_picture('img.jpg') #插入图片 默认大小
document.add_picture('img.jpg',Pt(50),Pt(80)) #传入参设置插入图片的大小# 插入表格
table = document.add_table(rows=1,cols=3) #设置一行三列的数据表
headerCells = table.rows[0].cells
headerCells[0].text = "月份"
headerCells[1].text = "预期产量"
headerCells[2].text = "实际产量"# 数据
data = (['一月份',100,120],['二月份',300,350],['三月份',600,500]
)for item in data:rowsCells = table.add_row().cells rowsCells[0].text = item[0]rowsCells[1].text = str(item[1])rowsCells[2].text = str(item[2])

执行结果:

3.3样式处理

包括样式设置以及删除已添加样式。

# 导入文件
from docx.enum.style import WD_STYLE_TYPEstyle = document.styles.add_style('textstyle',WD_STYLE_TYPE.PARAGRAPH)
style.font.size = Pt(5)
#删除样式
#document.styles['textstyle'].delete()# 插入段落 在这里插入文本样式作为参数传递
p1 = document.add_paragraph("针对市场情况有变,现在某某地区新增某某门店,请知悉。针对市场情况有变,现在某某地区新增某某门店,请知悉。""针对市场情况有变,现在某某地区新增某某门店,请知悉。针对市场情况有变,现在某某地区新增某某门店,请知悉。" ,style='textstyle')# 插入表格 这里也是
table = document.add_table(rows=1,cols=3,style='Medium List 1') 

 

四、保存文档

#3.保存文档
document.save("shop.docx")

五、Word转换PDF

安装依赖并导入

# 安装
pip install pywin32
# 导入
from win32com.client import constants,gencache

1.单个文件的转换
def createpdf(wordPath,pdfPath):word = gencache.EnsureDispatch('Word.Application')doc = word.Documents.Open(wordPath,ReadOnly=1)# 转换方法doc.ExportAsFixedFormat(pdfPath,constants.wdExportFormatPDF)word.Quit()
#单个文件的转换
createpdf('D:\CODE\VSCODE\python\demo\shop.docx','D:\CODE\VSCODE\python\demo\shop.pdf')    

执行之后可以看到生成了shop.pdf文件 。

 2.多个文件转换
# 对目录的操作 多文件转换pdf
import os#多个文件的转换
# print(os.listdir('.')) #当前文件夹下的所有文件#定义一个列表用来存放当前文件夹下所有的doc或者docx文件
wordfiles = []
# 遍历当前文件夹下的所有文件
for file in os.listdir('.'):if file.endswith(('doc','docx')): #如果以doc或者docx结果的都添加到wordfiles列表中wordfiles.append(file)
# print(wordfiles) 
# 
# 遍历doc和docx文件   
for file in wordfiles:filepath = os.path.abspath(file) # 获取到当前的文件路径index = filepath.rindex('.') #找到最后一次出现‘.’的地址pdfpath = filepath[:index]+'.pdf'   #filepath[:index] 获取从 filepath‘.’之前的字符 然后拼接'.pdf'# print(pdfpath) createpdf(filepath,pdfpath)  # 执行转换操作

执行文件之后文件夹生成了几个pdf文件。 

六、总结

本章主要总结了python-docx的第三方模块主要用于添加和修改word文件。

1.首先对python-docx模块进行安装并且导入依赖使用

2.模块的主要工作过程 新建文档对象 写入内容、保存文档

3.写入内容又分为写入文本、添加图片表格

4.对添加的段落、标题以及文字进行样式设置

5.word转换pdf单个文件和多个文件转换

有问题欢迎大家评论区留言指正,大家一起探讨学习一起进步,谢谢。

Python 办公自动化 处理 Excel 数据 | python环境下载安装 | python网络爬虫爬数据

 

这篇关于python-docx 实现 Word 办公自动化的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1091656

相关文章

python: 多模块(.py)中全局变量的导入

文章目录 global关键字可变类型和不可变类型数据的内存地址单模块(单个py文件)的全局变量示例总结 多模块(多个py文件)的全局变量from x import x导入全局变量示例 import x导入全局变量示例 总结 global关键字 global 的作用范围是模块(.py)级别: 当你在一个模块(文件)中使用 global 声明变量时,这个变量只在该模块的全局命名空

hdu1043(八数码问题,广搜 + hash(实现状态压缩) )

利用康拓展开将一个排列映射成一个自然数,然后就变成了普通的广搜题。 #include<iostream>#include<algorithm>#include<string>#include<stack>#include<queue>#include<map>#include<stdio.h>#include<stdlib.h>#include<ctype.h>#inclu

【C++】_list常用方法解析及模拟实现

相信自己的力量,只要对自己始终保持信心,尽自己最大努力去完成任何事,就算事情最终结果是失败了,努力了也不留遗憾。💓💓💓 目录   ✨说在前面 🍋知识点一:什么是list? •🌰1.list的定义 •🌰2.list的基本特性 •🌰3.常用接口介绍 🍋知识点二:list常用接口 •🌰1.默认成员函数 🔥构造函数(⭐) 🔥析构函数 •🌰2.list对象

【Prometheus】PromQL向量匹配实现不同标签的向量数据进行运算

✨✨ 欢迎大家来到景天科技苑✨✨ 🎈🎈 养成好习惯,先赞后看哦~🎈🎈 🏆 作者简介:景天科技苑 🏆《头衔》:大厂架构师,华为云开发者社区专家博主,阿里云开发者社区专家博主,CSDN全栈领域优质创作者,掘金优秀博主,51CTO博客专家等。 🏆《博客》:Python全栈,前后端开发,小程序开发,人工智能,js逆向,App逆向,网络系统安全,数据分析,Django,fastapi

让树莓派智能语音助手实现定时提醒功能

最初的时候是想直接在rasa 的chatbot上实现,因为rasa本身是带有remindschedule模块的。不过经过一番折腾后,忽然发现,chatbot上实现的定时,语音助手不一定会有响应。因为,我目前语音助手的代码设置了长时间无应答会结束对话,这样一来,chatbot定时提醒的触发就不会被语音助手获悉。那怎么让语音助手也具有定时提醒功能呢? 我最后选择的方法是用threading.Time

【Python编程】Linux创建虚拟环境并配置与notebook相连接

1.创建 使用 venv 创建虚拟环境。例如,在当前目录下创建一个名为 myenv 的虚拟环境: python3 -m venv myenv 2.激活 激活虚拟环境使其成为当前终端会话的活动环境。运行: source myenv/bin/activate 3.与notebook连接 在虚拟环境中,使用 pip 安装 Jupyter 和 ipykernel: pip instal

Android实现任意版本设置默认的锁屏壁纸和桌面壁纸(两张壁纸可不一致)

客户有些需求需要设置默认壁纸和锁屏壁纸  在默认情况下 这两个壁纸是相同的  如果需要默认的锁屏壁纸和桌面壁纸不一样 需要额外修改 Android13实现 替换默认桌面壁纸: 将图片文件替换frameworks/base/core/res/res/drawable-nodpi/default_wallpaper.*  (注意不能是bmp格式) 替换默认锁屏壁纸: 将图片资源放入vendo

C#实战|大乐透选号器[6]:实现实时显示已选择的红蓝球数量

哈喽,你好啊,我是雷工。 关于大乐透选号器在前面已经记录了5篇笔记,这是第6篇; 接下来实现实时显示当前选中红球数量,蓝球数量; 以下为练习笔记。 01 效果演示 当选择和取消选择红球或蓝球时,在对应的位置显示实时已选择的红球、蓝球的数量; 02 标签名称 分别设置Label标签名称为:lblRedCount、lblBlueCount

【机器学习】高斯过程的基本概念和应用领域以及在python中的实例

引言 高斯过程(Gaussian Process,简称GP)是一种概率模型,用于描述一组随机变量的联合概率分布,其中任何一个有限维度的子集都具有高斯分布 文章目录 引言一、高斯过程1.1 基本定义1.1.1 随机过程1.1.2 高斯分布 1.2 高斯过程的特性1.2.1 联合高斯性1.2.2 均值函数1.2.3 协方差函数(或核函数) 1.3 核函数1.4 高斯过程回归(Gauss

Kubernetes PodSecurityPolicy:PSP能实现的5种主要安全策略

Kubernetes PodSecurityPolicy:PSP能实现的5种主要安全策略 1. 特权模式限制2. 宿主机资源隔离3. 用户和组管理4. 权限提升控制5. SELinux配置 💖The Begin💖点点关注,收藏不迷路💖 Kubernetes的PodSecurityPolicy(PSP)是一个关键的安全特性,它在Pod创建之前实施安全策略,确保P