这里讨论使用Python解压如下五种压缩文件:

.gz .tar  .tgz .zip .rar

简介

gz: 即gzip,通常只能压缩一个文件。与tar结合起来就可以实现先打包,再压缩。

tar: linux系统下的打包工具,只打包,不压缩

tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件

zip: 不同于gzip,虽然使用相似的算法,可以打包压缩多个文件,不过分别压缩文件,压缩率低于tar。

rar:打包压缩文件,最初用于DOS,基于window操作系统。压缩率比zip高,但速度慢,随机访问的速度也慢。

关于zip于rar之间的各种比较,可见:

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz

由于gz一般只压缩一个文件,所有常与其他打包工具一起工作。比如可以先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz

解压gz,其实就是读出其中的单一文件,Python方法如下:

[python] view plain copy

 
  1. import gzip
  2. import os
  3. def un_gz(file_name):
  4. """ungz zip file"""
  5. f_name = file_name.replace(".gz", "")
  6. #获取文件的名称,去掉
  7. g_file = gzip.GzipFile(file_name)
  8. #创建gzip对象
  9. open(f_name, "w+").write(g_file.read())
  10. #gzip对象用read()打开后,写入open()建立的文件中。
  11. g_file.close()
  12. #关闭gzip对象

tar

XXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。

*注:tgz与tar.gz是相同的格式,老版本DOS扩展名最多三个字符,故用tgz表示。

由于这里有多个文件,我们先读取所有文件名,然后解压,如下:

[python] view plain copy

 
  1. import tarfile
  2. def un_tar(file_name):
  3. untar zip file"""
  4. tar = tarfile.open(file_name)
  5. names = tar.getnames()
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. #由于解压后是许多文件,预先建立同名文件夹
  11. for name in names:
  12. tar.extract(name, file_name + "_files/")
  13. tar.close()

*注:tgz文件与tar文件相同的解压方法。

zip

与tar类似,先读取多个文件名,然后解压,如下:

[python] view plain copy

 
  1. import zipfile
  2. def un_zip(file_name):
  3. """unzip zip file"""
  4. zip_file = zipfile.ZipFile(file_name)
  5. if os.path.isdir(file_name + "_files"):
  6. pass
  7. else:
  8. os.mkdir(file_name + "_files")
  9. for names in zip_file.namelist():
  10. zip_file.extract(names,file_name + "_files/")
  11. zip_file.close()

rar

因为rar通常为window下使用,需要额外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解压到Python安装目录的/Scripts/目录下,在当前窗口打开命令行,

输入Python setup.py install

安装完成。

[python] view plain copy

 
  1. import rarfile
  2. import os
  3. def un_rar(file_name):
  4. """unrar zip file"""
  5. rar = rarfile.RarFile(file_name)
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. os.chdir(file_name + "_files"):
  11. rar.extractall()
  12. rar.close()
tar打包
在写打包代码的过程中,使用tar.add()增加文件时,会把文件本身的路径也加进去,加上arcname就能根据自己的命名规则将文件加入tar包
打包代码:
  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import os
  5. import time
  6. start = time.time()
  7. tar=tarfile.open('/path/to/your.tar,'w')
  8. for root,dir,files in os.walk('/path/to/dir/'):
  9. for file in files:
  10. fullpath=os.path.join(root,file)
  11. tar.add(fullpath,arcname=file)
  12. tar.close()
  13. print time.time()-start
在打包的过程中可以设置压缩规则,如想要以gz压缩的格式打包
tar=tarfile.open('/path/to/your.tar.gz','w:gz')
其他格式如下表:
tarfile.open的mode有很多种:

mode action

'r' or 'r:*' Open for reading with transparent compression (recommended).
'r:' Open for reading exclusively without compression.
'r:gz' Open for reading with gzip compression.
'r:bz2' Open for reading with bzip2 compression.
'a' or 'a:' Open for appending with no compression. The file is created if it does not exist.
'w' or 'w:' Open for uncompressed writing.
'w:gz' Open for gzip compressed writing.
'w:bz2' Open for bzip2 compressed writing.
 
tar解包
tar解包也可以根据不同压缩格式来解压。
  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import time
  5. start = time.time()
  6. t = tarfile.open("/path/to/your.tar", "r:")
  7. t.extractall(path = '/path/to/extractdir/')
  8. t.close()
  9. print time.time()-start
 
上面的代码是解压所有的,也可以挨个起做不同的处理,但要如果tar包内文件过多,小心内存哦~
  1. tar = tarfile.open(filename, 'r:gz')
  2. for tar_info in tar:
  3. file = tar.extractfile(tar_info)
  4. do_something_with(file)

这里讨论使用Python解压如下五种压缩文件:

.gz .tar  .tgz .zip .rar

简介

gz: 即gzip,通常只能压缩一个文件。与tar结合起来就可以实现先打包,再压缩。

tar: linux系统下的打包工具,只打包,不压缩

tgz:即tar.gz。先用tar打包,然后再用gz压缩得到的文件

zip: 不同于gzip,虽然使用相似的算法,可以打包压缩多个文件,不过分别压缩文件,压缩率低于tar。

rar:打包压缩文件,最初用于DOS,基于window操作系统。压缩率比zip高,但速度慢,随机访问的速度也慢。

关于zip于rar之间的各种比较,可见:

http://www.comicer.com/stronghorse/water/software/ziprar.htm

gz

由于gz一般只压缩一个文件,所有常与其他打包工具一起工作。比如可以先用tar打包为XXX.tar,然后在压缩为XXX.tar.gz

解压gz,其实就是读出其中的单一文件,Python方法如下:

[python] view plain copy

 
  1. import gzip
  2. import os
  3. def un_gz(file_name):
  4. """ungz zip file"""
  5. f_name = file_name.replace(".gz", "")
  6. #获取文件的名称,去掉
  7. g_file = gzip.GzipFile(file_name)
  8. #创建gzip对象
  9. open(f_name, "w+").write(g_file.read())
  10. #gzip对象用read()打开后,写入open()建立的文件中。
  11. g_file.close()
  12. #关闭gzip对象

tar

XXX.tar.gz解压后得到XXX.tar,还要进一步解压出来。

*注:tgz与tar.gz是相同的格式,老版本DOS扩展名最多三个字符,故用tgz表示。

由于这里有多个文件,我们先读取所有文件名,然后解压,如下:

[python] view plain copy

 
  1. import tarfile
  2. def un_tar(file_name):
  3. untar zip file"""
  4. tar = tarfile.open(file_name)
  5. names = tar.getnames()
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. #由于解压后是许多文件,预先建立同名文件夹
  11. for name in names:
  12. tar.extract(name, file_name + "_files/")
  13. tar.close()

*注:tgz文件与tar文件相同的解压方法。

zip

与tar类似,先读取多个文件名,然后解压,如下:

[python] view plain copy

 
  1. import zipfile
  2. def un_zip(file_name):
  3. """unzip zip file"""
  4. zip_file = zipfile.ZipFile(file_name)
  5. if os.path.isdir(file_name + "_files"):
  6. pass
  7. else:
  8. os.mkdir(file_name + "_files")
  9. for names in zip_file.namelist():
  10. zip_file.extract(names,file_name + "_files/")
  11. zip_file.close()

rar

因为rar通常为window下使用,需要额外的Python包rarfile。

可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download

解压到Python安装目录的/Scripts/目录下,在当前窗口打开命令行,

输入Python setup.py install

安装完成。

[python] view plain copy

 
  1. import rarfile
  2. import os
  3. def un_rar(file_name):
  4. """unrar zip file"""
  5. rar = rarfile.RarFile(file_name)
  6. if os.path.isdir(file_name + "_files"):
  7. pass
  8. else:
  9. os.mkdir(file_name + "_files")
  10. os.chdir(file_name + "_files"):
  11. rar.extractall()
  12. rar.close()
tar打包
在写打包代码的过程中,使用tar.add()增加文件时,会把文件本身的路径也加进去,加上arcname就能根据自己的命名规则将文件加入tar包
打包代码:
  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import os
  5. import time
  6. start = time.time()
  7. tar=tarfile.open('/path/to/your.tar,'w')
  8. for root,dir,files in os.walk('/path/to/dir/'):
  9. for file in files:
  10. fullpath=os.path.join(root,file)
  11. tar.add(fullpath,arcname=file)
  12. tar.close()
  13. print time.time()-start
在打包的过程中可以设置压缩规则,如想要以gz压缩的格式打包
tar=tarfile.open('/path/to/your.tar.gz','w:gz')
其他格式如下表:
tarfile.open的mode有很多种:

mode action

'r' or 'r:*' Open for reading with transparent compression (recommended).
'r:' Open for reading exclusively without compression.
'r:gz' Open for reading with gzip compression.
'r:bz2' Open for reading with bzip2 compression.
'a' or 'a:' Open for appending with no compression. The file is created if it does not exist.
'w' or 'w:' Open for uncompressed writing.
'w:gz' Open for gzip compressed writing.
'w:bz2' Open for bzip2 compressed writing.
 
tar解包
tar解包也可以根据不同压缩格式来解压。
  1. #!/usr/bin/env /usr/local/bin/python
  2. # encoding: utf-8
  3. import tarfile
  4. import time
  5. start = time.time()
  6. t = tarfile.open("/path/to/your.tar", "r:")
  7. t.extractall(path = '/path/to/extractdir/')
  8. t.close()
  9. print time.time()-start
 
上面的代码是解压所有的,也可以挨个起做不同的处理,但要如果tar包内文件过多,小心内存哦~

  1. tar = tarfile.open(filename, 'r:gz')
  2. for tar_info in tar:
  3. file = tar.extractfile(tar_info)
  4. do_something_with(file)

python解压压缩包的几种方式的更多相关文章

  1. python解压压缩包的几种方法

    这里讨论使用Python解压例如以下五种压缩文件: .gz .tar  .tgz .zip .rar 简单介绍 gz: 即gzip.通常仅仅能压缩一个文件.与tar结合起来就能够实现先打包,再压缩. ...

  2. python 解压 压缩包

    转 http://m.blog.csdn.net/blog/wice110956/26597179# 这里讨论使用Python解压如下五种压缩文件: .gz .tar  .tgz .zip .rar ...

  3. python解压压缩包

    默认解压到当前目录 import shutil shutil.unpack_archive('/root/redis-3.2.3.tar.gz') 解压到home目录下 import shutil s ...

  4. python 解压、复制、删除 文件

    一.python3解压文件 1.python 解压文件代码示例 如下代码主要实现zip.rar.tar.tar.gz四种格式的压缩文件的解压 def unzip_file(src_file, dst_ ...

  5. node解压压缩包以及压缩图片

    node解压压缩包以及压缩图片 首先保证电脑安装node环境,下载地址:http://nodejs.cn //可以打开一个dos窗口输入node -v进行确认是否安装成功 C:\ > node ...

  6. 【转】python之配置日志的几种方式

    [转]python之配置日志的几种方式 作为开发者,我们可以通过以下3种方式来配置logging: 1)使用Python代码显式的创建loggers, handlers和formatters并分别调用 ...

  7. Python调用API接口的几种方式 数据库 脚本

    Python调用API接口的几种方式 2018-01-08 gaoeb97nd... 转自 one_day_day... 修改 微信分享: 相信做过自动化运维的同学都用过API接口来完成某些动作.AP ...

  8. python获取公网ip的几种方式

    python获取公网ip的几种方式 转 https://blog.csdn.net/conquerwave/article/details/77666226 from urllib2 import u ...

  9. Python调用API接口的几种方式

    Python调用API接口的几种方式 相信做过自动化运维的同学都用过API接口来完成某些动作.API是一套成熟系统所必需的接口,可以被其他系统或脚本来调用,这也是自动化运维的必修课. 本文主要介绍py ...

随机推荐

  1. 关于 DP 的一些内容

    0.关于         动态规划是编程解题的一种重要手段.1951 年美国数学家 R.Bellman 等人,根据一类多阶段问题的特点,把多阶段决策问题变换为一系列互相联系的单阶段问题,然后逐个加以解 ...

  2. Verilog-同步FIFO

    参考博客:https://blog.csdn.net/hengzo/article/details/49683707 1.基本框图 1)双端口RAM加两个读写指针 2)写数据.写使能.写满:读数据.读 ...

  3. 理解Android线程创建流程

    copy from : http://gityuan.com/2016/09/24/android-thread/ 基于Android 6.0源码剖析,分析Android线程的创建过程 /androi ...

  4. 使用 VMware Workstation Pro 安装新的虚拟机

     一.连接服务器 (1)“文件”右键 (2)输入用户名.密码连接服务器 二.创建新的虚拟机 (1) (2) (3) (4) (5) (6) (7) (8)  三.配置服务器 配置文档 - 链接:htt ...

  5. MyBatis mapper文件中使用常量

    MyBatis mapper文件中使用常量 Java 开发中会经常写一些静态常量和静态方法,但是我们在写sql语句的时候会经常用到判断是否等于 //静态类 public class CommonCod ...

  6. 我国自主开发的编程语言“木兰”居然是一个披着“洋”皮的Python!

    究竟是真“自主”,还是又一个披着“洋”皮的“红芯浏览器”? ​ 作者 | 沉迷单车的追风少年 出品 | CSDN博客 昨天看到新闻: ! ​ 心头一震,看起来很厉害啊!毕竟前几天美国宣布要对中国AI软 ...

  7. selenium等待机制

    等待机制 ​ 因为你要查找的标签由于网速等原因迟迟没有加载出来,你就直接获取这个标签,很明显是报错,现有的简单粗暴的解决办法就是time.sleep(3),睡几秒,也就是设置线程等待,等这个标签加载出 ...

  8. Android之活动Activity用法

    Activity是Android的四大组件之一,本篇将通过Activity的生命周期,Intent的组成部分以及如何使用Intent进行页面之间的消息传递来介绍它的基本用法. 1.activity的生 ...

  9. NSSM 将jar 安装成windows服务

    1.下载 nssm (下载地址: http://www.nssm.cc/release/nssm-2.24.zip ) 2.将打包好的jar包放到一个文件夹中,编写run.bat文件,run.bat内 ...

  10. Git和TortoiseGit

    1.简介 Git是一个开源的分布式版本控制系统,用于敏捷高效的处理任何或大或小的项目.它采用了分布式版本库的方式,不必服务器端软件支持. 2.Git和Svn的区别 1.Git 是分布式的,SVN 不是 ...