博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
linux压缩多文件,linux++压缩多个文件夹
阅读量:4362 次
发布时间:2019-06-07

本文共 3333 字,大约阅读时间需要 11 分钟。

这里讨论使用Python解压如下五种压缩文件:

.gz .tar .tgz .zip .rar

简介gz: 即gzip,通常只能压缩一个文件。与tar结合起来就可以实现先打包,再压缩。

tar: linux系统下的打包工具,只打包,不压缩

tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件

zip: 不同于gzip,虽然使用相似的算法,可以打包压缩多个文件,不过分别压缩文件,压缩率低于tar。

rar:打包压缩文件,最初用于DOS,基于window操作系统。压缩率比zip高,但速度慢,随机访问的速度也慢。

关于zip于rar之间的各种比较,可见:

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz由于gz一般只压缩一个文件,所有常与其他打包工具一起工作。比如可以先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz

解压gz,其实就是读出其中的单一文件,Python方法如下:

[python] view plain copyimport gzip import os def un_gz(file_name):

"""ungz zip file"""

f_name = file_name.replace(".gz", "")

#获取文件的名称,去掉

g_file = gzip.GzipFile(file_name)

#创建gzip对象

open(f_name, "w+").write(g_file.read())

#gzip对象用read()打开后,写入open()建立的文件中。

g_file.close()

#关闭gzip对象

tarXXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。

*注:tgz与tar.gz是相同的格式,老版本DOS扩展名最多三个字符,故用tgz表示。

由于这里有多个文件,我们先读取所有文件名,然后解压,如下:

[python] view plain copyimport tarfile def un_tar(file_name):

untar zip file"""

tar = tarfile.open(file_name)

names = tar.getnames()

if os.path.isdir(file_name + "_files"):

pass

else:

os.mkdir(file_name + "_files")

#由于解压后是许多文件,预先建立同名文件夹

for name in names:

tar.extract(name, file_name + "_files/")

tar.close()

*注:tgz文件与tar文件相同的解压方法。

zip与tar类似,先读取多个文件名,然后解压,如下:

[python] view plain copyimport zipfile def un_zip(file_name):

"""unzip zip file"""

zip_file = zipfile.ZipFile(file_name)

if os.path.isdir(file_name + "_files"):

pass

else:

os.mkdir(file_name + "_files")

for names in zip_file.namelist():

zip_file.extract(names,file_name + "_files/")

zip_file.close()

rar因为rar通常为window下使用,需要额外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解压到Python安装目录的/Scripts/目录下,在当前窗口打开命令行,

输入Python setup.py install

安装完成。

[python] view plain copyimport rarfile import os def un_rar(file_name):

"""unrar zip file"""

rar = rarfile.RarFile(file_name)

if os.path.isdir(file_name + "_files"):

pass

else:

os.mkdir(file_name + "_files")

os.chdir(file_name + "_files"):

rar.extractall()

rar.close()

tar打包在写打包代码的过程中,使用tar.add()增加文件时,会把文件本身的路径也加进去,加上arcname就能根据自己的命名规则将文件加入tar包打包代码:

!/usr/bin/env /usr/local/bin/python

# encoding: utf-8 import tarfile import os import time

start = time.time() tar=tarfile.open('/path/to/your.tar,'w') for root,dir,files in os.walk('/path/to/dir/'):

for file in files:

fullpath=os.path.join(root,file)

tar.add(fullpath,arcname=file)

tar.close() print time.time()-start

在打包的过程中可以设置压缩规则,如想要以gz压缩的格式打包tar=tarfile.open('/path/to/your.tar.gz','w:gz')其他格式如下表:tarfile.open的mode有很多种:mode action'r' or 'r:*' Open for reading with transparent compression (recommended).'r:' Open for reading exclusively without compression.'r:gz' Open for reading with gzip compression.'r:bz2' Open for reading with bzip2 compression.'a' or 'a:' Open for appending with no compression. The file is created if it does not exist.'w' or 'w:' Open for uncompressed writing.'w:gz' Open for gzip compressed writing.'w:bz2' Open for bzip2 compressed writing.

tar解包tar解包也可以根据不同压缩格式来解压。

!/usr/bin/env /usr/local/bin/python

# encoding: utf-8 import tarfile import time

start = time.time() t = tarfile.open("/path/to/your.tar", "r:") t.extractall(path = '/path/to/extractdir/') t.close() print time.time()-start

上面的代码是解压所有的,也可以挨个起做不同的处理,但要如果tar包内文件过多,小心内存哦~tar = tarfile.open(filename, 'r:gz') for tar_info in tar:

file = tar.extractfile(tar_info)

do_something_with(file)

转载地址:http://dhkfs.baihongyu.com/

你可能感兴趣的文章
20165227 结对编程项目-四则运算 第二周
查看>>
20155227 《Java程序设计》实验四 Android开发基础设计实验报告
查看>>
git pull时出现冲突 放弃本地修改,使远程库内容强制覆盖本地代码
查看>>
使用jquery-qrcode生成二维码
查看>>
wen文章表设计
查看>>
MPEG2_TS流基本概念和数据结构 分类: ffmpeg-SDL-V...
查看>>
【贪心】删数问题
查看>>
饼图,扇形,柱状图
查看>>
WebDAV配置
查看>>
不同浏览器窗口大小加载不同CSS样式
查看>>
定制SharePoint中列表项添加页面
查看>>
(译)Web是如何工作的(2):客户端-服务器模型,以及Web应用程序的结构
查看>>
最小堆理解
查看>>
Tomcat安装
查看>>
014.科普.有生产力的Sql语句
查看>>
C#中的stathread标签【待填的坑】
查看>>
CAD教程----圆的优化命令viewres
查看>>
text输入框改变事件
查看>>
求问,我想android开机不启动自带的界面,启动自己做的应用程序,该怎么做?...
查看>>
【2019/4/15】周进度报告
查看>>