如何用python合并多个excel文件
作者:huansky 发布时间:2022-08-23 19:30:24
标签:python,excel,合并文件
目录
安装模块
XlsxWriter 示例
合并Excel数据
表头都一样的 excel
表头都不一样的 excel
表头都不一样的 excel
安装模块
1、找到对应的模块 http://www.python-excel.org/
2、用 pip install 安装
pip3 install xlrd
pip3 install XlsxWriter
因为使用的是 python3,所以安装的时候采用 pip3。
XlsxWriter 示例
先看看简单的演示:
import xlsxwriter
# 创建一个工作簿并添加一个工作表
workbook = xlsxwriter.Workbook("c.xlsx")
worksheet = workbook.add_worksheet()
# 设置列宽
worksheet.set_column("A:A", 20)
# 设置格式
bold = workbook.add_format({"bold": True})
# 设置单元格的值
worksheet.write("A1", "Hello")
# 带格式的单元格
worksheet.write("A2", "World")
# 写一些数字,用行列标识
worksheet.write(2, 0, 123)
worksheet.write(3, 0, 123.456, bold)
# 插入一张图片
worksheet.insert_image("B5", "s.png")
# 关闭文件流
workbook.close()
运行结果如下:
合并Excel数据
对于合并 excel,有两种 case ,一种是表头都是一样的,一种是表头不一样的excel ,但是希望放到同一个表格里面,方便查看
表头都一样的 excel
这个处理很简单,具体代码如下:
import xlrd
import xlsxwriter
source_xls = ["a.xlsx", "b.xlsx"]
target_xls = "3.xlsx"
# 读取数据
data = []
for i in c:
wb = xlrd.open_workbook(i)
for sheet in wb.sheets():
for rownum in range(sheet.nrows):
data.append(sheet.row_values(rownum))
print(data)
# 写入数据
workbook = xlsxwriter.Workbook(target_xls)
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
for i in range(len(data)):
for j in range(len(data[i])):
worksheet.write(i, j, data[i][j], font)
# 关闭文件流
workbook.close()
Excel 是由行和列组成的,所以这里将所有文件中的所有 sheet 中的数据读取出来组成一个二维数组,然后再写入新的 Excel。
表头都不一样的 excel
对于表头不一样的 excel,可能需要手动选取表格的一部分,然后进行合并。具体代码如下:
import xlrd
import xlsxwriter
source_xls = ["a.xlsx", "b.xlsx"]
target_xls = "合并.xlsx"
# 读取数据
data = []
# 重复数据
dupdata = []
# 姓名列表,按照姓名去重
name = []
# 获取excel的个数
sheetcount = len(source_xls)
i = 0
while i < len(source_xls):
wb = xlrd.open_workbook(source_xls[i])
# 存储不同excel 的数据
data.append([])
# 一个excel 可能存在多张表格
for sheet in wb.sheets():
if i == 0:
# 先把表头添加进去
dupdata.append(sheet.row_values(0))
for rownum in range(sheet.nrows):
# 判断名字是否重复,表头都是姓名开头的,所以把姓名除去
if (sheet.row_values(rownum)[0] in name):
dupdata.append(sheet.row_values(rownum))
# 给数据添加另一个表的表头
if (sheet.row_values(rownum)[0] == '姓名'):
data[i].append(sheet.row_values(rownum))
else:
name.append(sheet.row_values(rownum)[0])
data[i].append(sheet.row_values(rownum))
i+=1
# 合并数据
workbook = xlsxwriter.Workbook(target_xls)
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
lineNum = 0
for num in range(len(data)):
# 区分来自不同excel 的数据
if num== 0 :
for i in range(len(data[num])):
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][23], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][14], font)
# 黄标
worksheet.write(lineNum, 4, data[num][i][19], font)
worksheet.write(lineNum, 5, data[num][i][20], font)
worksheet.write(lineNum, 6, data[num][i][21], font)
# 大小
worksheet.write(lineNum, 7, data[num][i][24], font)
worksheet.write(lineNum, 8, data[num][i][25], font)
worksheet.write(lineNum, 9, data[num][i][26], font)
lineNum += 1
# 只有两个excel ,所以直接用了 else
else:
for i in range(len(data[num])):
lineNum += 1
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][2], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][30], font)
# 关闭文件流
workbook.close()
# 针对重复数据,连表头一起输出,方便后续回顾查看
workbook = xlsxwriter.Workbook("重复.xlsx")
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
for i in range(len(dupdata)):
for j in range(len(dupdata[i])):
worksheet.write(i, j, dupdata[i][j], font)
# 关闭文件流
workbook.close()
Excel 是由行和列组成的,所以这里将所有文件中的所有 sheet 中的数据读取出来组成一个二维数组,然后再写入新的 Excel。
表头都不一样的 excel
对于表头不一样的 excel,可能需要手动选取表格的一部分,然后进行合并。具体代码如下:
import xlrd
import xlsxwriter
source_xls = ["a.xlsx", "b.xlsx"]
target_xls = "合并.xlsx"
# 读取数据
data = []
# 重复数据
dupdata = []
# 姓名列表,按照姓名去重
name = []
# 获取excel的个数
sheetcount = len(source_xls)
i = 0
while i < len(source_xls):
wb = xlrd.open_workbook(source_xls[i])
# 存储不同excel 的数据
data.append([])
# 一个excel 可能存在多张表格
for sheet in wb.sheets():
if i == 0:
# 先把表头添加进去
dupdata.append(sheet.row_values(0))
for rownum in range(sheet.nrows):
# 判断名字是否重复,表头都是姓名开头的,所以把姓名除去
if (sheet.row_values(rownum)[0] in name):
dupdata.append(sheet.row_values(rownum))
# 给数据添加另一个表的表头
if (sheet.row_values(rownum)[0] == '姓名'):
data[i].append(sheet.row_values(rownum))
else:
name.append(sheet.row_values(rownum)[0])
data[i].append(sheet.row_values(rownum))
i+=1
# 合并数据
workbook = xlsxwriter.Workbook(target_xls)
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
lineNum = 0
for num in range(len(data)):
# 区分来自不同excel 的数据
if num== 0 :
for i in range(len(data[num])):
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][23], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][14], font)
# 黄标
worksheet.write(lineNum, 4, data[num][i][19], font)
worksheet.write(lineNum, 5, data[num][i][20], font)
worksheet.write(lineNum, 6, data[num][i][21], font)
# 大小
worksheet.write(lineNum, 7, data[num][i][24], font)
worksheet.write(lineNum, 8, data[num][i][25], font)
worksheet.write(lineNum, 9, data[num][i][26], font)
lineNum += 1
# 只有两个excel ,所以直接用了 else
else:
for i in range(len(data[num])):
lineNum += 1
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][2], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][30], font)
# 关闭文件流
workbook.close()
# 针对重复数据,连表头一起输出,方便后续回顾查看
workbook = xlsxwriter.Workbook("重复.xlsx")
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
for i in range(len(dupdata)):
for j in range(len(dupdata[i])):
worksheet.write(i, j, dupdata[i][j], font)
# 关闭文件流
workbook.close()
合并后的结果
重复列表结果如下:
来源:https://www.cnblogs.com/huansky/p/14492070.html


猜你喜欢
- 安装好mysql后,配制文件应该在/usr/local/mysql/share/mysql目录中,配制文件有几个,有my- huge.cnf
- 今天我和中国著名画家"渔人"谈了一个关于"怎样才能设计好"的问题,他给我说了一句话,得益不浅,那句话
- Django 简介Django是一个开放源代码的Web应用框架,由Python写成。采用了MTV的框架模式,即模型M,视图V和模版T。它最初
- 函数画图以 z = x 2 + y 2 为例#导入模块import numpy as npimport matplotlib.py
- 概述Redis是一个开源,先进的key-value存储,并用于构建高性能,可扩展的Web应用程序的完美解决方案。Redis从它的许多竞争继承
- 前言今天跟大家介绍一个开源项目:id-maker,主要功能是用来在分布式环境下生成唯一 ID。上周停更了一周,也是用来开发和测试这个项目的相
- 需求有一个表,里面数据量比较大,每天一更新,其字段可以通过xml配置文件进行配置,即,可能每次建表的字段不一样。上游跑时会根据配置从源文件中
- 为了测试一组网页是否能够访问,采取python中的requests包进行批量的访问测试,并输出访问结果。一、requests包的安装 打开命
- 为什么要手动添加核?因为使用公司的服务器,最好不要直接使用anaconda自带的python,更不要使用系统下自带的python,如果每个人
- MVVM模式不但可用于Form表单,在复杂的管理页面中也能大显身手。例如,分页显示Blog的功能,我们先把后端代码写出来:在apis.py中
- 本文实例讲述了python实现同时给多个变量赋值的方法。分享给大家供大家参考。具体分析如下:python中可以同时给多个变量赋值,下面列举了
- 1. 迭代根据记录的前面的元素的位置信息 去访问后续的元素的过程 -遍历 迭代2. 可迭代对象 iterable如何判断可迭代对象的3种方式
- 前言一个Excel电子表格文档称为一个工作簿一个工作簿保存在一个扩展名为.xlsx的文件中一个工作簿可以包含多个表用户当前查看的
- 1、XML 是什么?XML仅仅是一种数据存放格式,这种格式是一种文本(虽然XML规范中也提供了存放二进制数据的解决方案)。事实上有很多文本格
- 举例写文章详情页面的时候的一个场景:首先更改文章详情中的 PV,然后读取文章详情,然后根据文章详情中文章 Id 查阅该文章评论和该文章作者信
- shutil --High-level file operations 高级的文件操作模块os模块提供了对目录或者文件的新建/删除/查看文件
- 首先先定义一个list,将其转存为csv文件,看将会报什么错误list=[[1,2,3],[4,5,6],[7,9,9]]list.to_c
- 1.背景一直苦恼于本地机器和服务器上都要配置一些机器学习方面的环境,今天花了点时间研究了下Jupter notebook远程访问服务器,所以
- 增加索引可以提高查询效率。增加索引就是增加一个索引文件,存放的是数据的地址,类似与我们文档的目录,在查找过程中可以不用从书的内容查找,直接根
- 本文介绍了微信小程序滑动选择器的实现代码,分享给大家,具体如下:实现微信小程序滑动选择效果在wxml文件中,用一个picker标签代表选择器