如何删除文件中的特定行?

假设我有一个充满昵称的文本文件。如何使用Python从这个文件中删除特定的昵称?

当前回答

我认为如果你把文件读入一个列表，然后你可以遍历这个列表来寻找你想要去掉的昵称。您可以在不创建额外文件的情况下高效地执行此操作，但必须将结果写回源文件。

以下是我可能的做法:

import, os, csv # and other imports you need
nicknames_to_delete = ['Nick', 'Stephen', 'Mark']

我假设nicknames.csv包含如下数据:

Nick
Maria
James
Chris
Mario
Stephen
Isabella
Ahmed
Julia
Mark
...

然后将文件加载到列表中:

 nicknames = None
 with open("nicknames.csv") as sourceFile:
     nicknames = sourceFile.read().splitlines()

接下来，迭代到list以匹配要删除的输入:

for nick in nicknames_to_delete:
     try:
         if nick in nicknames:
             nicknames.pop(nicknames.index(nick))
         else:
             print(nick + " is not found in the file")
     except ValueError:
         pass

最后，将结果写回文件:

with open("nicknames.csv", "a") as nicknamesFile:
    nicknamesFile.seek(0)
    nicknamesFile.truncate()
    nicknamesWriter = csv.writer(nicknamesFile)
    for name in nicknames:
        nicknamesWriter.writeRow([str(name)])
nicknamesFile.close()

2016-04-24 18:31:31

其他回答

您可以使用re库

假设您能够加载完整的txt文件。然后定义一个不需要的昵称列表，然后用空字符串“”替换它们。

# Delete unwanted characters
import re

# Read, then decode for py2 compat.
path_to_file = 'data/nicknames.txt'
text = open(path_to_file, 'rb').read().decode(encoding='utf-8')

# Define unwanted nicknames and substitute them
unwanted_nickname_list = ['SourDough']
text = re.sub("|".join(unwanted_nickname_list), "", text)

2019-08-08 16:01:22

在第一次传递中读取行并在第二次传递中进行更改(删除特定行)的问题是，如果文件大小很大，则会耗尽RAM。相反，更好的方法是逐行读取，并将它们写入单独的文件，删除不需要的文件。我曾经在12- 50gb大的文件上运行过这种方法，RAM使用几乎保持不变。只有CPU周期显示正在进行的处理。

2013-11-06 22:03:37

一般来说，你不能;您必须重新编写整个文件(至少从更改点到末尾)。

在某些特定的情况下，你可以做得比这个更好

如果所有的数据元素都是相同的长度，并且没有特定的顺序，并且您知道要删除的数据元素的偏移量，那么您可以将最后一项复制到要删除的数据元素之上，并在最后一项之前截断文件;

或者你可以用“这是坏数据，跳过它”的值覆盖数据块，或者在保存的数据元素中保留“此项已删除”的标记，这样你就可以在不修改文件的情况下标记它已删除。

对于短文档(小于100 KB的文档?)来说，这可能有点过分了。

2011-01-17 05:55:48

首先，打开文件并从文件中获取所有的行。然后以写模式重新打开文件，写回你想要删除的行:

with open("yourfile.txt", "r") as f:
    lines = f.readlines()
with open("yourfile.txt", "w") as f:
    for line in lines:
        if line.strip("\n") != "nickname_to_delete":
            f.write(line)

您需要去掉比较中的换行符(“\n”)，因为如果您的文件不以换行符结束，那么最后一行也不会以换行符结束。

2011-01-17 04:44:37