解压缩文件而不创建临时文件

沃梦达教程 Python问题

2022-01-01

unzip file without creating temporary files(解压缩文件而不创建临时文件)

本文介绍了解压缩文件而不创建临时文件的处理方法，对大家解决问题具有一定的参考价值，需要的朋友们下面随着小编来一起学习吧！

问题描述

我从AWS S3下载了一个zip文件并解压缩。解压缩后，所有文件都保存在tmp/文件夹中。

s3 = boto3.client('s3')

s3.download_file('testunzipping','DataPump_10000838.zip','/tmp/DataPump_10000838.zip')

with zipfile.ZipFile('/tmp/DataPump_10000838.zip', 'r') as zip_ref:
    zip_ref.extractall('/tmp/')
    lstNEW = zip_ref.namelist()

listNEW的输出如下所示：

['DataPump_10000838/', '__MACOSX/._DataPump_10000838', 'DataPump_10000838/DockBooking', '__MACOSX/DataPump_10000838/._DockBooking', 'DataPump_10000838/LoadEquipment', '__MACOSX/DataPump_10000838/._LoadEquipment', ....]

LoadEquipment和DockBooking是文件，但睡觉不是。是否可以在不创建这些临时文件的情况下解压缩文件？或者我可以用过滤把真正的文件发出去吗？因为稍后，我需要使用正确的文件并将其压缩。

$item_$unixepochtimestamp.csv.gz

是否使用压缩功能？

推荐答案

若要仅解压缩某些文件，您可以将列表传递给extractall：

with zipfile.ZipFile('/tmp/DataPump_10000838.zip', 'r') as zip_ref:
    lstNEW = list(filter(lambda x: not x.startswith("__MACOSX/"), zip_ref.namelist()))
    zip_ref.extractall('/tmp/', members=lstNEW)

这些文件不是临时文件，而是MacOS在通常不支持此功能的zip文件中表示资源分叉的方式。

这篇关于解压缩文件而不创建临时文件的文章就介绍到这了，希望我们推荐的答案对大家有所帮助，也希望大家多多支持编程学习网！

沃梦达教程

本文标题为：解压缩文件而不创建临时文件