這里討論使用Python解壓例如以下五種壓縮文件:
.gz .tar .tgz .zip .rar
簡單介紹
gz: 即gzip。通常僅僅能壓縮一個文件。與tar結合起來就能夠實現先打包,再壓縮。
tar: linux系統下的打包工具。僅僅打包。不壓縮
tgz:即tar.gz。先用tar打包,然后再用gz壓縮得到的文件
zip: 不同於gzip。盡管使用相似的算法,能夠打包壓縮多個文件。只是分別壓縮文件。壓縮率低於tar。
rar:打包壓縮文件。最初用於DOS,基於window操作系統。
壓縮率比zip高,但速度慢。隨機訪問的速度也慢。
關於zip於rar之間的各種比較。可見:
http://www.comicer.com/stronghorse/water/software/ziprar.htm
gz
因為gz一般僅僅壓縮一個文件,全部常與其它打包工具一起工作。比方能夠先用tar打包為XXX.tar,然后在壓縮為XXX.tar.gz
解壓gz,事實上就是讀出當中的單一文件,Python方法例如以下:
import gzip import os def un_gz(file_name): """ungz zip file""" f_name = file_name.replace(".gz", "") #獲取文件的名稱,去掉 g_file = gzip.GzipFile(file_name) #創建gzip對象 open(f_name, "w+").write(g_file.read()) #gzip對象用read()打開后,寫入open()建立的文件里。 g_file.close() #關閉gzip對象
tar
XXX.tar.gz解壓后得到XXX.tar,還要進一步解壓出來。
*注:tgz與tar.gz是同樣的格式,老版本號DOS擴展名最多三個字符,故用tgz表示。
因為這里有多個文件,我們先讀取全部文件名稱。然后解壓。例如以下:
import tarfile def un_tar(file_name): untar zip file""" tar = tarfile.open(file_name) names = tar.getnames() if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") #因為解壓后是很多文件,預先建立同名目錄 for name in names: tar.extract(name, file_name + "_files/") tar.close()
*注:tgz文件與tar文件同樣的解壓方法。
zip
與tar類似,先讀取多個文件名稱,然后解壓。例如以下:
import zipfile def un_zip(file_name): """unzip zip file""" zip_file = zipfile.ZipFile(file_name) if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") for names in zip_file.namelist(): zip_file.extract(names,file_name + "_files/") zip_file.close()
rar
由於rar通常為window下使用,須要額外的Python包rarfile。
可用地址: http://sourceforge.net/projects/rarfile.berlios/files/rarfile-2.4.tar.gz/download
解壓到Python安裝文件夾的/Scripts/文件夾下,在當前窗體打開命令行,
輸入Python setup.py install
安裝完畢。
import rarfile import os def un_rar(file_name): """unrar zip file""" rar = rarfile.RarFile(file_name) if os.path.isdir(file_name + "_files"): pass else: os.mkdir(file_name + "_files") os.chdir(file_name + "_files"): rar.extractall() rar.close()
- #!/usr/bin/env /usr/local/bin/python
- # encoding: utf-8
- import tarfile
- import os
- import time
- start = time.time()
- tar=tarfile.open('/path/to/your.tar,'w')
- for root,dir,files in os.walk('/path/to/dir/'):
- for file in files:
- fullpath=os.path.join(root,file)
- tar.add(fullpath,arcname=file)
- tar.close()
- print time.time()-start
'r' or 'r:*' | Open for reading with transparent compression (recommended). |
'r:' | Open for reading exclusively without compression. |
'r:gz' | Open for reading with gzip compression. |
'r:bz2' | Open for reading with bzip2 compression. |
'a' or 'a:' | Open for appending with no compression. The file is created if it does not exist. |
'w' or 'w:' | Open for uncompressed writing. |
'w:gz' | Open for gzip compressed writing. |
'w:bz2' | Open for bzip2 compressed writing. |
- #!/usr/bin/env /usr/local/bin/python
- # encoding: utf-8
- import tarfile
- import time
- start = time.time()
- t = tarfile.open("/path/to/your.tar", "r:")
- t.extractall(path = '/path/to/extractdir/')
- t.close()
- print time.time()-start
- tar = tarfile.open(filename, 'r:gz')
- for tar_info in tar:
- file = tar.extractfile(tar_info)
- do_something_with(file)