如何在python中找到文件的mime类型?

假设您想要在某个地方保存一堆文件，例如在blob中。假设您希望通过网页分发这些文件，并让客户端自动打开正确的应用程序/查看器。

假设:浏览器通过HTTP响应中的mime-type (content-type?)报头确定要使用哪个应用程序/查看器。

基于这个假设，除了文件的字节外，还需要保存MIME类型。

如何找到文件的MIME类型?我现在用的是Mac，但这应该也适用于Windows。

浏览器是否在将文件发布到网页时添加此信息?

是否有一个简洁的python库来查找这些信息?WebService还是(更好的)一个可下载的数据库?

当前回答

2017年更新

不需要去github，它在PyPi上以不同的名字:

pip3 install --user python-magic
# or:
sudo apt install python3-magic  # Ubuntu distro package

代码也可以简化:

>>> import magic

>>> magic.from_file('/tmp/img_3304.jpg', mime=True)
'image/jpeg'

2017-10-15 19:09:35

其他回答

比使用mimetypes库更可靠的方法是使用python-magic包。

import magic
m = magic.open(magic.MAGIC_MIME)
m.load()
m.file("/tmp/document.pdf")

这相当于使用file(1)。

在Django中，还可以确保MIME类型与UploadedFile.content_type匹配。

2010-01-25 16:39:06

@toivotuo的方法在python3下工作得最好，最可靠。我的目标是识别那些没有可靠的.gz扩展名的gzip文件。我安装了python3-magic。

import magic

filename = "./datasets/test"

def file_mime_type(filename):
    m = magic.open(magic.MAGIC_MIME)
    m.load()
    return(m.file(filename))

print(file_mime_type(filename))

对于一个gzip文件，它返回: 应用程序/ gzip;charset =二进制

对于解压缩的TXT文件(iostat数据): 文本/平原;charset = us - ascii

对于tar文件: 应用程序/ x-tar;charset =二进制

对于bz2文件: 应用程序/ x-bzip2;charset =二进制

最后但并非最不重要的一个。zip文件: 应用程序/邮政编码;charset =二进制

2015-02-03 19:09:32

toivotuo提出的蟒蛇魔法方法已经过时了。Python-magic当前的主干在Github，基于那里的自述me，找到mime类型，是这样做的。

# For MIME types
import magic
mime = magic.Magic(mime=True)
mime.from_file("testdata/test.pdf") # 'application/pdf'

2010-05-02 12:02:45

mimetypes模块只是基于文件扩展名来识别文件类型。如果尝试恢复没有扩展名的文件的文件类型，mimetypes将不起作用。

2012-06-19 12:51:55

对于可以使用的数组类型数据 magic.from_buffer (_byte_array mime = True)

2018-07-25 04:43:28

如何在python中找到文件的mime类型?

推荐文章

最新文章

标签