如何在文件夹层次结构中找到所有不同的文件扩展名?

在Linux机器上，我希望遍历一个文件夹层次结构，并获得其中所有不同文件扩展名的列表。

从外壳中实现这一点的最佳方法是什么?

当前回答

在Python中，为非常大的目录使用生成器，包括空白扩展名，并获取每个扩展名出现的次数:

import json
import collections
import itertools
import os

root = '/home/andres'
files = itertools.chain.from_iterable((
    files for _,_,files in os.walk(root)
    ))
counter = collections.Counter(
    (os.path.splitext(file_)[1] for file_ in files)
)
print json.dumps(counter, indent=2)

2012-08-24 19:17:28

其他回答

我的无awk、无sed、无perl、无python的posix兼容替代方案:

find . -type f | rev | cut -d. -f1 | rev  | tr '[:upper:]' '[:lower:]' | sort | uniq --count | sort -rn

诀窍在于它将行反转，并在开始处切断扩展。它还将扩展名转换为小写。

示例输出:

   3689 jpg
   1036 png
    610 mp4
     90 webm
     90 mkv
     57 mov
     12 avi
     10 txt
      3 zip
      2 ogv
      1 xcf
      1 trashinfo
      1 sh
      1 m4v
      1 jpeg
      1 ini
      1 gqv
      1 gcs
      1 dv

2019-03-23 18:37:54

因为已经有了另一个使用Perl的解决方案:

如果你安装了Python，你还可以这样做(从shell):

python -c "import os;e=set();[[e.add(os.path.splitext(f)[-1]) for f in fn]for _,_,fn in os.walk('/home')];print '\n'.join(e)"

2009-12-04 08:27:53

我想这个还没有被提到:

find . -type f -exec sh -c 'echo "${0##*.}"' {} \; | sort | uniq -c

2018-05-21 23:01:17

到目前为止，没有一个回复正确地处理带有换行符的文件名(除了ChristopheD的，它是在我输入这篇文章时出现的)。下面不是一个shell一行程序，但是可以工作，并且相当快。

import os, sys

def names(roots):
    for root in roots:
        for a, b, basenames in os.walk(root):
            for basename in basenames:
                yield basename

sufs = set(os.path.splitext(x)[1] for x in names(sys.argv[1:]))
for suf in sufs:
    if suf:
        print suf

2009-12-04 08:35:28

你也可以这样做

find . -type f -name "*.php" -exec PATHTOAPP {} +

2013-03-25 16:12:15

如何在文件夹层次结构中找到所有不同的文件扩展名?

推荐文章

最新文章

标签