Python快速优雅的批量修改Word文档样式
作者:早起python 发布时间:2022-09-23 19:28:22
目录
需求描述
步骤分析和前置知识
代码实现
写在最后
需求描述
手上现有若干份财务分析报告的Word文档,如下:
每一份Word文档中的内容如下:
为了方便后续审阅,需要将所有文档中所有含有资金的语句标红加粗,如图所示
步骤分析和前置知识
为了解决这个需求简单复习一下相关知识。Word文档一般而言由文档(document) - 段落(paragraph) - 文字块(run) * 结构组成:
从需求反馈中可以看出,本质上我们需要做的就是对所有含有资金的文字块Run进行样式调整
因此,本需求的逻辑如下:
1.创建一个空文件夹(用于存放修改后的财务报告,避免直接对原文件修改)
2.通过glob获取目标文件夹下的所有Word路径
3.利用docx模块对每个Word文档遍历,并获取包含特定词的文字块
4.对文字块进行样式修改
代码实现
首先导入需要的库并设置目标文件夹路径
from docx import Document
from docx.shared import RGBColor, Pt, Cm
import os
import glob
# 此处更换创建文件夹的路径
mkdir_path = r'C:\Users\xxx\new_dir'
# 此处更换所有文件所在的位置
file_path = r'C:\Users\xxx\'
os和glob我们都很熟悉,这里简单介绍一下docx模块 这是一个非标准库,在命令行中我们需要输入以下命令安装:
pip install python-docx
尤其要注意安装时候输入的是python-docx,而实际调用时为docx
实例化具体的Word文档代码为:
from docx import Document
wordfile = Document(path)
如果不指定路径则为创建新的Word文档,这点跟操作Excel的openpyxl不太一样,有机会再做介绍。
现在我们建立文件夹存放新生成的文件,首先判断文件夹是否存在,不存在时再运行os.mkdir避免报错
if not os.path.exists(mkdir_path):
os.mkdir(mkdir_path)
接着遍历Word文档,利用glob模块的通配符,框架如下:
for file in glob.glob(file_path + '/*.docx'):
pass
根据 * 结构,一个文档Document有一个或多个段落Paragragh,一个段落Paragraph有一个或多个文字块Run,合起来代码为:
for file in glob.glob(file_path + '/*.docx'):
docx = Document(file)
for paragraph in docx.paragraphs:
for run in paragraph.runs:
pass
最后我们针对特定词修改样式,遍历到文字块后就可以做判断了
...
for run in paragraph.runs:
if '资金' in run.text:
run.font.bold = True # 加粗
run.font.color.rgb = RGBColor(255, 0, 255) # 设置字体颜色
# 最后切记保存
docx.save(mkdir_path + '/' + os.path.basename(file))
当然,除了修改字体颜色和加粗之外,还支持其他样式的设置,以下列出常用的作为参考:
# 加粗
run.font.bold = True
# 斜体
run.font.italic = True
# 下划线
run.font.underline = True
# 删除线
run.font.strike = True
# 字号
run.font.size = Pt(20)
# 阴影
run.font.shadow = True
# 字体颜色
run.font.color.rgb = RGBColor(255, 0, 255)
至此,整个需求就顺利结束了,附上完整代码:
from docx import Document
from docx.shared import RGBColor, Pt, Cm
import os
import glob
mkdir_path = r'C:\xxx\new_dir)'
if not os.path.exists(mkdir_path):
os.mkdir(mkdir_path)
keyword = '资金'
file_path = r'C:\Users\xxx'
for file in glob.glob(file_path + '\*.docx'):
docx = Document(file)
for paragraph in docx.paragraphs:
for run in paragraph.runs:
if keyword in run.text:
run.font.bold = True
run.font.color.rgb = RGBColor(255, 0, 0)
docx.save(mkdir_path + '/' + os.path.basename(file))
写在最后
通过本文的Python自动化脚本制作过程,我们可以再次体会Python办公自动化的强大!如果对自动化代码和数据感兴趣可以在后台回复自动化获取。
当然除了调整Word字体颜色,其他的大多数样式调整都可以使用Python完成,也可以与Excel和PPT结合,这些就留给读者自己开发。
最后还是希望大家能够理解Python办公自动化的一个核心就是批量操作-解放双手,让复杂的工作自动化!
来源:https://mp.weixin.qq.com/s/Mjh14NCo7CIlAQvEWYPKRw


猜你喜欢
- 在thoughtbot,我们用Ruby和Rails工作,但通常我们总是尝试使用最合适的语言或者框架来解决问题。我最近一直在探索机器学习技术,
- 1.样式的重用性CSS布局的网页最大的特点就是样式的可重用性,利用class选择符重复将某个样式属性多次在网页中使用,以减少不断定义样式属性
- Cookies的处理作用保存客户端的相关状态在爬虫中如果遇到了cookie的反爬如何处理?手动处理 在抓
- 本文实例讲述了wxPython定时器wx.Timer简单应用。分享给大家供大家参考。具体如下:# -*- coding: utf-8 -*-
- 列表转化为字符串如下所示:>>> list1=['ak','uk',4]>>&
- 导 读vue3.0中,响应式数据部分弃用了 Object.defineProperty ,使用 Proxy 来代替它。本文将主要通过以下方面
- 本文实例为大家分享了python实现抽奖小程序的具体代码,供大家参考,具体内容如下设计一个抽奖服务 背景:有x个奖品,要求在y天内
- VueUse官方链接一、什么是VueUseVueUse不是Vue.use,它是为Vue 2和3服务的一套Vue Composition AP
- digo工具地址:https://github.com/werbenhu/digo特性使用注释中的注解自动代码生成自动检测循环依赖编译时期依
- 一. 背景公司又要做一个新项目,是一个合作型项目,我们公司出web展示服务,合作伙伴线下提供展示数据。而且本次项目是数据统计展示为主要功能,
- 前言在对网站整体性能进行benchmark时,可以使用多种工具,比如大名鼎鼎的ab(Apache bench),http_load等工具。这
- 需求当需要同时ping/telnet多个ip时,可以通过引入ping包/telnet包实现,也可以通过go调用cmd命令实现,不过后者调用效
- Python四种逐行读取文件内容的方法下面四种Python逐行读取文件内容的方法, 分析了各种方法的优缺点及应用场景,以下代码在python
- 本文实例讲述了Python在字典中将键映射到多个值上的方法。分享给大家供大家参考,具体如下:问题:一个能将键(key)映射到多个值的字典(即
- 如何显示一个文本文件?完整显示文本文件的代码如下: Write(STRING) WriteLine(STRING) WriteBlan
- 1.建表-- Create table create table test ( dm1 char(3), dm2 char(3), mc1
- Pycharm的下方工具栏中有两个窗口:Python Console和Terminal(如下图)其中,Python Console叫做Pyt
- 为了吸引更多的用户,设计好一个分享海报还是很有必要的。而小程序要生成一个海报还是有点坑的,下面分享下我们打卡小程序的一些经验。分享海报的效果
- # 递归满足的条件# 1.自己调用自己# 2.必须有一个明确的结束条件# 优点:逻辑简单\定义简单# 缺点:防止内存消耗过多,容易导致栈溢出
- 一、数据类型分类1、按存值个数区分单个值:数字,字符串多个值(容器):列表,元组,字典,集合2、按可变不可变区分可变:列表[],字典{},集