如何用python合并多个excel文件
作者:huansky 发布时间:2022-08-23 19:30:24
标签:python,excel,合并文件
目录
安装模块
XlsxWriter 示例
合并Excel数据
表头都一样的 excel
表头都不一样的 excel
表头都不一样的 excel
安装模块
1、找到对应的模块 http://www.python-excel.org/
2、用 pip install 安装
pip3 install xlrd
pip3 install XlsxWriter
因为使用的是 python3,所以安装的时候采用 pip3。
XlsxWriter 示例
先看看简单的演示:
import xlsxwriter
# 创建一个工作簿并添加一个工作表
workbook = xlsxwriter.Workbook("c.xlsx")
worksheet = workbook.add_worksheet()
# 设置列宽
worksheet.set_column("A:A", 20)
# 设置格式
bold = workbook.add_format({"bold": True})
# 设置单元格的值
worksheet.write("A1", "Hello")
# 带格式的单元格
worksheet.write("A2", "World")
# 写一些数字,用行列标识
worksheet.write(2, 0, 123)
worksheet.write(3, 0, 123.456, bold)
# 插入一张图片
worksheet.insert_image("B5", "s.png")
# 关闭文件流
workbook.close()
运行结果如下:
合并Excel数据
对于合并 excel,有两种 case ,一种是表头都是一样的,一种是表头不一样的excel ,但是希望放到同一个表格里面,方便查看
表头都一样的 excel
这个处理很简单,具体代码如下:
import xlrd
import xlsxwriter
source_xls = ["a.xlsx", "b.xlsx"]
target_xls = "3.xlsx"
# 读取数据
data = []
for i in c:
wb = xlrd.open_workbook(i)
for sheet in wb.sheets():
for rownum in range(sheet.nrows):
data.append(sheet.row_values(rownum))
print(data)
# 写入数据
workbook = xlsxwriter.Workbook(target_xls)
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
for i in range(len(data)):
for j in range(len(data[i])):
worksheet.write(i, j, data[i][j], font)
# 关闭文件流
workbook.close()
Excel 是由行和列组成的,所以这里将所有文件中的所有 sheet 中的数据读取出来组成一个二维数组,然后再写入新的 Excel。
表头都不一样的 excel
对于表头不一样的 excel,可能需要手动选取表格的一部分,然后进行合并。具体代码如下:
import xlrd
import xlsxwriter
source_xls = ["a.xlsx", "b.xlsx"]
target_xls = "合并.xlsx"
# 读取数据
data = []
# 重复数据
dupdata = []
# 姓名列表,按照姓名去重
name = []
# 获取excel的个数
sheetcount = len(source_xls)
i = 0
while i < len(source_xls):
wb = xlrd.open_workbook(source_xls[i])
# 存储不同excel 的数据
data.append([])
# 一个excel 可能存在多张表格
for sheet in wb.sheets():
if i == 0:
# 先把表头添加进去
dupdata.append(sheet.row_values(0))
for rownum in range(sheet.nrows):
# 判断名字是否重复,表头都是姓名开头的,所以把姓名除去
if (sheet.row_values(rownum)[0] in name):
dupdata.append(sheet.row_values(rownum))
# 给数据添加另一个表的表头
if (sheet.row_values(rownum)[0] == '姓名'):
data[i].append(sheet.row_values(rownum))
else:
name.append(sheet.row_values(rownum)[0])
data[i].append(sheet.row_values(rownum))
i+=1
# 合并数据
workbook = xlsxwriter.Workbook(target_xls)
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
lineNum = 0
for num in range(len(data)):
# 区分来自不同excel 的数据
if num== 0 :
for i in range(len(data[num])):
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][23], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][14], font)
# 黄标
worksheet.write(lineNum, 4, data[num][i][19], font)
worksheet.write(lineNum, 5, data[num][i][20], font)
worksheet.write(lineNum, 6, data[num][i][21], font)
# 大小
worksheet.write(lineNum, 7, data[num][i][24], font)
worksheet.write(lineNum, 8, data[num][i][25], font)
worksheet.write(lineNum, 9, data[num][i][26], font)
lineNum += 1
# 只有两个excel ,所以直接用了 else
else:
for i in range(len(data[num])):
lineNum += 1
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][2], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][30], font)
# 关闭文件流
workbook.close()
# 针对重复数据,连表头一起输出,方便后续回顾查看
workbook = xlsxwriter.Workbook("重复.xlsx")
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
for i in range(len(dupdata)):
for j in range(len(dupdata[i])):
worksheet.write(i, j, dupdata[i][j], font)
# 关闭文件流
workbook.close()
Excel 是由行和列组成的,所以这里将所有文件中的所有 sheet 中的数据读取出来组成一个二维数组,然后再写入新的 Excel。
表头都不一样的 excel
对于表头不一样的 excel,可能需要手动选取表格的一部分,然后进行合并。具体代码如下:
import xlrd
import xlsxwriter
source_xls = ["a.xlsx", "b.xlsx"]
target_xls = "合并.xlsx"
# 读取数据
data = []
# 重复数据
dupdata = []
# 姓名列表,按照姓名去重
name = []
# 获取excel的个数
sheetcount = len(source_xls)
i = 0
while i < len(source_xls):
wb = xlrd.open_workbook(source_xls[i])
# 存储不同excel 的数据
data.append([])
# 一个excel 可能存在多张表格
for sheet in wb.sheets():
if i == 0:
# 先把表头添加进去
dupdata.append(sheet.row_values(0))
for rownum in range(sheet.nrows):
# 判断名字是否重复,表头都是姓名开头的,所以把姓名除去
if (sheet.row_values(rownum)[0] in name):
dupdata.append(sheet.row_values(rownum))
# 给数据添加另一个表的表头
if (sheet.row_values(rownum)[0] == '姓名'):
data[i].append(sheet.row_values(rownum))
else:
name.append(sheet.row_values(rownum)[0])
data[i].append(sheet.row_values(rownum))
i+=1
# 合并数据
workbook = xlsxwriter.Workbook(target_xls)
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
lineNum = 0
for num in range(len(data)):
# 区分来自不同excel 的数据
if num== 0 :
for i in range(len(data[num])):
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][23], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][14], font)
# 黄标
worksheet.write(lineNum, 4, data[num][i][19], font)
worksheet.write(lineNum, 5, data[num][i][20], font)
worksheet.write(lineNum, 6, data[num][i][21], font)
# 大小
worksheet.write(lineNum, 7, data[num][i][24], font)
worksheet.write(lineNum, 8, data[num][i][25], font)
worksheet.write(lineNum, 9, data[num][i][26], font)
lineNum += 1
# 只有两个excel ,所以直接用了 else
else:
for i in range(len(data[num])):
lineNum += 1
# 姓名
worksheet.write(lineNum, 0, data[num][i][0], font)
# 检查编号
worksheet.write(lineNum, 1, data[num][i][1], font)
# 年龄
worksheet.write(lineNum, 2, data[num][i][2], font)
# 蓝标
worksheet.write(lineNum, 3, data[num][i][30], font)
# 关闭文件流
workbook.close()
# 针对重复数据,连表头一起输出,方便后续回顾查看
workbook = xlsxwriter.Workbook("重复.xlsx")
worksheet = workbook.add_worksheet()
font = workbook.add_format({"font_size": 14})
for i in range(len(dupdata)):
for j in range(len(dupdata[i])):
worksheet.write(i, j, dupdata[i][j], font)
# 关闭文件流
workbook.close()
合并后的结果
重复列表结果如下:
来源:https://www.cnblogs.com/huansky/p/14492070.html
0
投稿
猜你喜欢
- 其实所有的死锁最深层的原因就是一个:资源竞争。表现一:一个用户A 访问表A(锁住了表A),然后又访问表B
- (1)应用于客户需要与不同的数据源进行交互时。数据可能来自不同的数据库,他们都有各自不同的复杂格式。但客户与这些数据库间只通过一种标准语言进
- 1. 打开FrontPage 2003,点击“文件→新建→新建网站→其他网站模板”,然后选择“数据库界面向导”,给定网站路径后,单击[确定]
- Ajax在网上已经叫喊了好几年了, 但是还是有很多像我这样的新手没掌握它, 像这样能改善交互体验的技术不会用真是很遗憾呢. 所以我就把我学到
- 现代浏览器可以基于RFC 2397标准使用base64把图片进行编码,然后输出类似data:image/png;base64,iVBORw0
- 经典鼠标控制左右滚动,图片间隔无缝滚动,悬停滚动,图片控制左右滚动JavaScript代码<!DOCTYPE html PUBLIC
- 1.如果有ID字段,就是具有唯一性的字段 代码如下:delect table where id not in ( select max(id
- 最近的项目中大量涉及数据的预处理工作,对于ndarray的使用非常频繁。其中ndarray如何进行数值筛选,总结了几种方法。1.按某些固定值
- 在任何编辑器中,获取光标位置都是非常重要的,很多人可能认为较难,其实只要处理好浏览器的兼容,还是比较容易实现的。下面我们一起来看看如何获取到
- 我想大多写web的朋友应该和我一样,正则是不可少的,可是每次到用时去百度一下,也麻烦,存在电脑里也得找半天~换了电脑还是得靠google了~
- 在本节中,我们将详细介绍 Python 标准库中的 json 模块。JSON(JavaScript Objec
- 原型扩展:>> String.prototype :String对象原型扩展 --------------
- 在讲解 seek() 函数和 tell() 函数之前,首先来了解一下什么是文件指针。我们知道,使用 open() 函数打开文件并读取文件中的
- //********************** index.asp ************************//<
- 用python实现FTP文件传输,包括服务器端和客户端,要求(1)客户端访问服务器端要有一个验证功能(2)可以有多个客户端访问服务器端(3)
- 因一些特殊需求需要以参数的形式获取字典 * 定的值,网上搜了一下并没有特别好的实现(并没有太认真去找~),所以自己实现了一个,以供大家参考:)
- /* JS代码部分 */ 3 const date = new Date()const years = []const months = [
- 大家在用asp开发程序的时候,有时候会碰到以下的错误提示:Active Server Pages 错误 'ASP 0141'
- assert断言声明,遇到错误则立即返回在使用python语言开发深度学习模型时,经常会遇到模型运行结束时才会发现的崩溃状态,或者得到的结果
- '*************************************************'函数名:getMaxO