位置：首页>> 网络编程>> Python编程>> Python实现将Word表格嵌入到Excel中

Python实现将Word表格嵌入到Excel中

作者：酸菜鱼编程　　发布时间：2022-02-10 06:21:49　

标签：Python,Word,Excel

今日需求

其实就是把Word中的表格转到Excel中，顺便做一个调整。这个需求在实际工作中，很多人还是经常碰到的！

如果单单是两个表格，那只要简单的复制黏贴即可，但如果上百了呢？那就得考虑自动化了。好在今天碰到的需求中的原文件格式是比较有规律的，那直接来尝试一下。

# 首先要pip install python-docx
# 如果原文件是doc格式，那就先转成docx
from docx import Document
import pandas as pd

path = "./word表格转excel.docx"
docx = Document(path)
table_s = docx.tables # 返回一个Table对象的列表

len(table_s) --> 2 # 返回值是2，因为原文件中只有两个表格

list_ = [] # 初始化一个空列表，用来装后面的dict_

for table in table_s: # 循环所有的表格列表
dict_ = {}
dict_['名称'] = table.cell(0, 1).text # 表格的索引是从（0行，0列）开始
dict_['身份'] = table.cell(0, 3).text
dict_['简介'] = table.cell(1, 1).text
for i in range(3, len(table.rows)): # 后续的内容格式不固定，所以循环获取
dict_[table.cell(i, 0).text] = table.cell(i, 1).text
list_.append(dict_)

当完成上述操作后,list_就会是一个字典列表。

接下来，将列表转为DataFrame进行操作即可。

df = pd.DataFrame(list_)

# 先将前三列作为索引，然后逆透视其他列，其实这就是个一维表转二维表的过程
df = df.set_index(['名称', '身份', '简介']).stack(level=0).to_frame()

# 重新设置一下行列索引的名字
df.index.names = ['名称', '身份', '简介', '物质']
df.columns = ['现状']

此时的df就跟需求结果相差不大了。

最后将DataFrame导出，稍作美化即可完成需求。

# 导出的时候一定要设置index=True不然只会保留一列Series
df.to_excel("data3.xlsx", index=True, merge_cells=True)

完整代码

# 首先要pip install python-docx
# 如果原文件是doc格式，那就先转成docx
from docx import Document
import pandas as pd

path = "./word表格转excel.docx"
docx = Document(path)
table_s = docx.tables # 返回一个Table对象的列表

list_ = [] # 初始化一个空列表，用来装后面的dict_

for table in table_s: # 循环所有的表格列表
dict_ = {}
dict_['名称'] = table.cell(0, 1).text # 表格的索引是从（0行，0列）开始的
dict_['身份'] = table.cell(0, 3).text
dict_['简介'] = table.cell(1, 1).text
for i in range(3, len(table.rows)): # 循环获得后面的内容
dict_[table.cell(i, 0).text] = table.cell(i, 1).text
list_.append(dict_)

df = pd.DataFrame(list_)

# 先将前三列作为索引，然后逆透视其他列，就是个一维表转二维表的过程
df = df.set_index(['名称', '身份', '简介']).stack(level=0).to_frame()

# 重新设置一下行列索引的名字
df.index.names = ['名称', '身份', '简介', '物质']
df.columns = ['现状']

# 导出的时候一定要设置index=True不然只会保留一列Series
df.to_excel("data3.xlsx", index=True, merge_cells=True)

来源：https://blog.csdn.net/pythonxuexi123/article/details/115027653

投稿

Python实现将Word表格嵌入到Excel中

猜你喜欢