Python处理压缩文件主要用zipfile和tarfile标准库,支持ZIP、GZIP、BZ2、XZ等格式,但不支持RAR、7z;zipfile适合跨平台小文件打包,tarfile适合Linux场景并保留权限等元信息。
Python 中处理压缩文件主要靠 zipfile 和 tarfile 两个标准库,它们无需额外安装,覆盖 ZIP、GZIP、BZ2、XZ 等常见格式,但不支持 RAR、7z 等需第三方库的格式。
zipfile 支持创建、解压、查看、追加 ZIP 文件,适合处理单个压缩包或批量打包小文件。
ZipFile.extractall() 一键解到指定目录,路径不存在会自动创建.namelist() 获取所有成员名,.getinfo(name) 查大小、修改时间等元数据'w' 模式打开,用 .write() 添加本地文件,或 .writestr() 直接写入字符串内容(如生成配置文件)ZipFile(..., 'r', encoding='utf-8')
tarfile 更适合
Linux/Unix 场景,能完整保留权限、用户组、软硬链接、修改时间等元信息。
.tar.gz → gzip,.tar.xz → xz),也可显式指定 mode='r:gz'
tar.getnames() 检查文件名,过滤含 '../' 或绝对路径的项,再调用 extractall()
.add() 可递归加入整个目录;若只加特定文件,可用 .addfile() 配合 TarInfo 手动构造条目实际使用中容易遇到编码错乱、权限丢失、大文件卡顿等问题。
立即学习“Python免费学习笔记(深入)”;
encoding='gbk'(旧版 Windows)或 encoding='utf-8'(现代系统+正确打包)extractall() 后手动 os.chmod(),或用 tar.extract() 单个处理并设 tarinfo.mode
extractall(),改用循环 extract() 或流式读取内容(read() + 解码)处理单个文件pyminizip 或 zipfile 配合 pycryptodome 自行实现取决于目标平台和需求重点。
zipfile 接口简洁)tarfile 更可靠)setuptools 或 build 工具生成 wheel/sdist,而非手写压缩逻辑