从字符串中删除所有特殊字符、标点符号和空格

我需要从字符串中删除所有特殊字符，标点符号和空格，以便我只有字母和数字。

当前回答

这将删除字符串中的所有特殊字符、标点符号和空格，只包含数字和字母。

import re

sample_str = "Hel&&lo %% Wo$#rl@d"

# using isalnum()
print("".join(k for k in sample_str if k.isalnum()))


# using regex
op2 = re.sub("[^A-Za-z]", "", sample_str)
print(f"op2 = ", op2)


special_char_list = ["$", "@", "#", "&", "%"]

# using list comprehension
op1 = "".join([k for k in sample_str if k not in special_char_list])
print(f"op1 = ", op1)


# using lambda function
op3 = "".join(filter(lambda x: x not in special_char_list, sample_str))
print(f"op3 = ", op3)

2021-05-11 08:29:55

其他回答

假设你想要使用正则表达式并且你想要/需要unicode - cognant 2。X代码是2to3-ready:

>>> import re
>>> rx = re.compile(u'[\W_]+', re.UNICODE)
>>> data = u''.join(unichr(i) for i in range(256))
>>> rx.sub(u'', data)
u'0123456789ABCDEFGHIJKLMNOPQRSTUVWXYZabcdefghijklmnopqrstuvwxyz\xaa\xb2 [snip] \xfe\xff'
>>>

2011-04-30 21:07:48

较短的方法:

import re
cleanString = re.sub('\W+','', string )

如果你想在单词和数字之间有空格，用''代替''

2014-08-07 13:26:24

import re
abc = "askhnl#$%askdjalsdk"
ddd = abc.replace("#$%","")
print (ddd)

你会看到你的结果是

'Askhnlaskdjalsdk

2016-02-25 08:00:02

与使用正则表达式的其他人不同，我将尝试排除不是我想要的每个字符，而不是显式地列举我不想要的字符。

例如，如果我只想要字符从'a到z'(大写和小写)和数字，我将排除所有其他:

import re
s = re.sub(r"[^a-zA-Z0-9]","",s)

这意味着“用空字符串替换每个不是数字的字符，或者'a到z'或'a到z'范围内的字符”。

事实上，如果你在正则表达式的第一个位置插入特殊字符^，你将得到否定。

额外提示:如果您还需要将结果小写，您可以使正则表达式更快更简单，只要您现在不会发现任何大写。

import re
s = re.sub(r"[^a-z0-9]","",s.lower())

2018-09-05 10:02:41

这可以不使用regex完成:

>>> string = "Special $#! characters   spaces 888323"
>>> ''.join(e for e in string if e.isalnum())
'Specialcharactersspaces888323'

你可以使用str.isalnum:

S.isalnum() -> bool 如果S中的所有字符都是字母数字，则返回True 且S中至少有一个字符，否则为假。

如果坚持使用正则表达式，其他解决方案也可以。但是请注意，如果可以在不使用正则表达式的情况下完成，那么这是最好的方法。

2011-04-30 17:47:39

从字符串中删除所有特殊字符、标点符号和空格

推荐文章

最新文章

标签