Python在后台自动解压各种压缩文件的实现方法
作者:mrr 发布时间:2022-10-04 17:59:59
1.需求描述
编写一个 Python 程序,每次下载压缩包形式的文件后,自动将内部文件解压到当前文件夹后将压缩包删除,通过本案例可以学到的知识点:
os 模块综合应用
glob 模块综合应用
利用 gzip zipfile rarfile tarfile 模块解压文件
2.步骤分析和前置知识
码代码之前需要将复杂问题解释成多个明确的要求,即这个程序实现的逻辑为:
定时检测某个文件夹(如 download 文件夹)是否存在压缩文件
如果有新出现的压缩文件则将其解压到当前文件夹内的新文件夹中 删除压缩文件
提到压缩文件就要分不同压缩格式进行讨论,主要有以下4种:
提到压缩文件就要分不同压缩格式进行讨论,主要有以下4种:
.gz: 即 gzip,通常只能压缩一个文件
.tar: 本质上不是压缩工具而是打包工具,可以跟 .gz 配合形成 .tar.gz 的打包压缩格式 .zip: 和 .tar.gz 很类似但可以打包压缩多个文件
.rar: 打包压缩文件,最初用于 DOS
因此,文件是否为压缩文件的判断逻辑可以如下:
建立一个含压缩包后缀的列表 compressed_lst = ['gz', 'tar', 'zip', 'rar']
目标文件夹下的所有文件名运行 filename.split(.)[-1] 获取后缀名
判断后缀名是否在 compressed_lst 中,如果存在则运行后续的解压代码
如果是以 gz 结尾的文件,解压后需要再次判断是否是以 .tar 结尾,并进行相应处理
不同压缩文件的解压代码各不相同,在后续代码操作中具体展开。
3.代码实现
首先是获取 download 文件夹下所有文件的文件名
import glob
import os
path = r'C:\xxxx\download'
file_lst = glob.glob(path + '/*')
# 列表推导式
filename_lst = [os.path.basename(i) for i in file_lst]
print(filename_lst)
接下来根据文件的后缀名判断是否需要压缩,先看一下代码框架
for i in filename_lst:
if '.' in i:
# 获取后缀名
suffix = i.split('.')[-1]
# 逐个将后缀名和各格式的压缩后缀匹配
if suffix == 'gz':
pass
if ...: # 再次判断新产生的文件名是否以 .tar 结尾
pass
if suffix == 'tar':
pass
if suffix == 'zip':
pass
if suffix == 'rar':
pass
这里有2个注意点:
有些文件没有后缀名,因此可能不存在 .,这时用 filename.split('.')[-1]会报错,因此需要先判断
以.gz 结尾的文件,解压后需要再次判断是否是以 .tar 结尾,然后我们就可以分别将四种压缩文件的解压代码写成函数,符合时候单独调用即可
1、处理.gz 文件
import gzip
def ungz(filename):
filename = filename[:-3] # gz文件的单文件解压就是去掉 filename 后面的 .gz
gz_file = gzip.GzipFile(filename)
with open(filename, "w+") as file:
file.write(gz_file.read())
return filename # 这个gzip的函数需要返回值以进一步配合untar函数
前面反复提及的 gz 文件有可能跟 tar 文件配合,因此解压 gz 文件后需要再判断是否有必要解开 tar 文件
这里就可以先把 tar 文件的函数写出来
2、处理.tar文件
import tarfile
def untar(filename):
tar = tarfile.open(filename)
names = tar.getnames()
# tar本身是将文件打包,解除打包会产生很多文件,因此需要建立文件夹存放
if not os.path.isdir(filename + "_dir"):
os.mkdir(filename + "_dir")
for name in names:
tar.extract(name, filename + "_dir/")
tar.close()
3、处理.zip文件
import zipfile
def unzip(filename):
zip_file = zipfile.ZipFile(filename)
# 类似tar解除打包,建立文件夹存放解压的多个文件
if not os.path.isdir(filename + "_dir"):
os.mkdir(filename + "_dir")
for names in zip_file.namelist():
zip_file.extract(names, filename + "_dir/")
zip_file.close()
4、处理.rar文件
import rarfile
def unrar(filename):
rar = rarfile.RarFile(filename)
if not os.path.isdir(filename + "_dir"):
os.mkdir(filename + "_dir")
os.chdir(filename + "_dir")
rar.extractall()
rar.close()
可以看到,四种解压代码略有不同,推荐大家实际演示中自己体会一下差别,解压后配合 os.remove() 就可以删除压缩包,现在看看逻辑框架补上解压函数后的内容:
for filename in filename_lst:
if '.' in filename:
suffix = filename.split('.')[-1]
if suffix == 'gz':
new_filename = ungz(filename)
os.remove(filename)
if new_filename.split('.')[-1] == 'tar':
untar(new_filename)
os.remove(new_filename)
if suffix == 'tar':
untar(filename)
os.remove(filename)
if suffix == 'zip':
unzip(filename)
os.remove(filename)
if suffix == 'rar':
unrar(filename)
os.remove(filename)
5、实现实时检测
比较简单的方法就是建立 while True 死循环配合 time.sleep()睡眠,框架如下:
import time
while True:
func()
time.sleep(5) # 睡眠秒数可以设置大一点避免过度占用资源
最后将第二步的实现代码改为函数并放在循环框架中就可以完成本次需求,完整代码如下
import glob
import os
import gzip
import tarfile
import zipfile
import rarfile
import time
path = r'C:\xxxx\download'
file_lst = glob.glob(path + '/*')
filename_lst = [os.path.basename(i) for i in file_lst]
def ungz(filename):
filename = filename[:-3]
gz_file = gzip.GzipFile(filename)
with open(filename, "w+") as file:
file.write(gz_file.read())
return filename
def untar(filename):
tar = tarfile.open(filename)
names = tar.getnames()
if not os.path.isdir(filename + "_dir"):
os.mkdir(filename + "_dir")
for name in names:
tar.extract(name, filename + "_dir/")
tar.close()
def unzip(filename):
zip_file = zipfile.ZipFile(filename)
if not os.path.isdir(filename + "_dir"):
os.mkdir(filename + "_dir")
for names in zip_file.namelist():
zip_file.extract(names, filename + "_dir/")
zip_file.close()
def unrar(filename):
rar = rarfile.RarFile(filename)
if not os.path.isdir(filename + "_dir"):
os.mkdir(filename + "_dir")
os.chdir(filename + "_dir")
rar.extractall()
rar.close()
def unzip_files():
for filename in filename_lst:
if '.' in filename:
suffix = filename.split('.')[-1]
if suffix == 'gz':
new_filename = ungz(filename)
os.remove(filename)
if new_filename.split('.')[-1] == 'tar':
untar(new_filename)
os.remove(new_filename)
if suffix == 'tar':
untar(filename)
os.remove(filename)
if suffix == 'zip':
unzip(filename)
os.remove(filename)
if suffix == 'rar':
unrar(filename)
os.remove(filename)
while True:
unzip_files()
time.sleep(5)
猜你喜欢
- 1、定义和使用列表在Python中,列表是由一系列元素按照特定的顺序构成的数据结构,也就是说列表类型的变量可以存储多个数据,且可以重复。1.
- SQL Server 2008的独到之处:安装SQL Server 2008的设置和安装也有所改进。配置数据和引擎位已经分开了,所以它使创建
- 爬取结果:爬取代码import osimport jsonimport requestsfrom tqdm import tqdmdef l
- 如果想设置相同的初值和想要的长度>>> a=[None]*4>>> print(a)[None, Non
- 本次目标是将一副图像从rgb颜色空间转换到hsv颜色空间,颜色去除白色背景部分具体就调用了cv2的两个函数,一个是rgb转hsv的函数具体用
- 最近项目中需要实现两组图片对比,并能将两者的区别标识出来。在网上搜索一大堆找到一篇大神的文章,最终实现该功能,在这里记录下:想要实现此dem
- 常用 ASCII 码表对照表:注意如下几点:0-9:48-57A-Z:65-90a-z:97-122ord()函数介绍: ord(
- 用tensorflow构建简单的线性回归模型是tensorflow的一个基础样例,但是原有的样例存在一些问题,我在实际调试的过程中做了一点自
- 这篇文章主要介绍了Django app配置多个数据库代码实例,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需
- 前言在我们日常生活中,时间概念常伴我们左右。让我们简单的回忆一下自己的一天,大致有以下时间点:8:00,清晨的阳光照射到床头伴着闹钟,你从睡
- asp fso type属性取得文件类型代码是用来返回类型指定的文件或文件夹。语法FileObject.Type FolderObject.
- 有些页面并不能直接用requests获取到内容,会动态执行一些js代码生成内容。这个文章主要是对付那些特殊页面的,比如必须要进行js调用才能
- 最初我们介绍到 Matplotlib 可以绘制2D图形,并且介绍了一些常见图形的绘制方法,其实不仅可以绘制2D图形,现在较新版本的 Matp
- Python图片处理模块PIL(pillow)pywin32的主要作用1.捕获窗口;2.模拟鼠标键盘动作;3.自动获取某路径下文件列表;4.
- 本文实例为大家分享了JavaScript实现贪吃蛇的具体代码,供大家参考,具体内容如下首先我们要确定贪吃蛇应有的功能1.通过键盘的上下左右控
- 本文实例为大家分享了python3实现弹弹球小游戏的具体代码,供大家参考,具体内容如下from tkinter import *from t
- 一、腾讯语音合成介绍腾讯云语音合成技术(TTS)可以将任意文本转化为语音,实现让机器和应用张口说话。 腾讯TTS技术可以应用到很多场景,比如
- 服务器响应HTTP的类型ContentType大全,使用方法:<% Response.ContentType =&
- 导言在前面的教程我们看到了如何使用两个页面(一个主页,用于列出供应商; 一个明细页,用于显示选定供应商提供的产品)创建主/从报表 . 这种两
- 写在前面我的 CUDA 版本是什么? 这个问题本身就是有问题的,因为没有搞清楚cuda的分类这里的 CUDA 说的是 Driver CUDA