获取目录中经过筛选的文件列表

我试图使用Python获取目录中的文件列表，但我不想要所有文件的列表。

我本质上想要的是做以下事情的能力，但使用Python而不执行ls。

ls 145592*.jpg

如果没有内置方法，我目前正在考虑编写一个for循环来遍历os.listdir()的结果，并将所有匹配的文件附加到一个新列表中。

但是，该目录中有很多文件，因此我希望有一个更有效的方法(或内置方法)。

当前回答

在“path/to/images”中扩展名为“jpg”和“png”的文件名:

import os
accepted_extensions = ["jpg", "png"]
filenames = [fn for fn in os.listdir("path/to/images") if fn.split(".")[-1] in accepted_extensions]

2018-03-22 18:38:33

其他回答

您可以定义模式并检查它。在这里，我已经采取了开始和结束模式，并在文件名中寻找它们。FILES包含目录中所有文件的列表。

import os
PATTERN_START = "145592"
PATTERN_END = ".jpg"
CURRENT_DIR = os.path.dirname(os.path.realpath(__file__))
for r,d,FILES in os.walk(CURRENT_DIR):
    for FILE in FILES:
        if PATTERN_START in FILE.startwith(PATTERN_START) and PATTERN_END in FILE.endswith(PATTERN_END):
            print FILE

2019-11-14 05:42:30

glob()绝对是实现它的方式(根据Ignacio)。然而，如果你确实需要更复杂的匹配，你可以用一个列表理解和re.match()来做，就像这样:

files = [f for f in os.listdir('.') if re.match(r'[0-9]+.*\.jpg', f)]

更灵活了，但正如你所说，效率降低了。

2010-02-09 00:27:32

import glob

jpgFilenamesList = glob.glob('145592*.jpg')

参见python文档中的glob

2010-02-08 23:05:18

保持简单:

import os
relevant_path = "[path to folder]"
included_extensions = ['jpg','jpeg', 'bmp', 'png', 'gif']
file_names = [fn for fn in os.listdir(relevant_path)
              if any(fn.endswith(ext) for ext in included_extensions)]

我更喜欢这种形式的列表推导式，因为它的英文可读性很好。

我把第四行读成: 对于os中的每一个fn。Listdir为我的路径，只给我匹配任何一个我所包含的扩展。

对于python程序员新手来说，可能很难真正习惯使用列表推导式进行过滤，而且对于非常大的数据集可能会有一些内存开销，但对于列出目录和其他简单的字符串过滤任务，列表推导式会带来更干净的可记录的代码。

关于这种设计的唯一问题是，它不能防止您犯传递字符串而不是列表的错误。例如，如果您意外地将一个字符串转换为一个列表，并最终检查字符串的所有字符，您可能最终会得到大量的假阳性结果。

但有一个容易解决的问题总比有一个难以理解的解决方案要好。

2014-01-13 16:27:48

初步的代码

import glob
import fnmatch
import pathlib
import os

pattern = '*.py'
path = '.'

解决方案1 -使用“glob”

# lookup in current dir
glob.glob(pattern)

In [2]: glob.glob(pattern)
Out[2]: ['wsgi.py', 'manage.py', 'tasks.py']

解决方案 2 - 使用“os” + “fnmatch”

变体2.1 -查找当前目录

# lookup in current dir
fnmatch.filter(os.listdir(path), pattern)

In [3]: fnmatch.filter(os.listdir(path), pattern)
Out[3]: ['wsgi.py', 'manage.py', 'tasks.py']

变体2.2 -查找递归

# lookup recursive
for dirpath, dirnames, filenames in os.walk(path):

    if not filenames:
        continue

    pythonic_files = fnmatch.filter(filenames, pattern)
    if pythonic_files:
        for file in pythonic_files:
            print('{}/{}'.format(dirpath, file))

结果

./wsgi.py
./manage.py
./tasks.py
./temp/temp.py
./apps/diaries/urls.py
./apps/diaries/signals.py
./apps/diaries/actions.py
./apps/diaries/querysets.py
./apps/library/tests/test_forms.py
./apps/library/migrations/0001_initial.py
./apps/polls/views.py
./apps/polls/formsets.py
./apps/polls/reports.py
./apps/polls/admin.py

解决方案3 -使用“pathlib”

# lookup in current dir
path_ = pathlib.Path('.')
tuple(path_.glob(pattern))

# lookup recursive
tuple(path_.rglob(pattern))

注:

在Python 3.4上测试模块“pathlib”只在Python 3.4中添加 Python 3.5使用glob.glob添加了递归查找的特性 https://docs.python.org/3.5/library/glob.html glob.glob。由于我的机器安装了Python 3.4，所以我还没有对此进行测试。

2016-11-12 19:32:00

获取目录中经过筛选的文件列表

推荐文章

最新文章

标签