采用以下正则表达式:/^[^abc]/。这将匹配字符串开头的任何单个字符,a、b或c除外。
如果在其后面添加*–/^[^abc]*/–正则表达式将继续向结果中添加每个后续字符,直到它满足a、b或c。
例如,对于源字符串“qwerty qwerty whatever abc hello”,表达式将匹配到“qwerty-qwerty wh”。
但如果我希望匹配的字符串是“qwerty qwerty whatever”呢?
换句话说,我如何将所有内容都匹配到(但不包括)精确的序列“abc”?
采用以下正则表达式:/^[^abc]/。这将匹配字符串开头的任何单个字符,a、b或c除外。
如果在其后面添加*–/^[^abc]*/–正则表达式将继续向结果中添加每个后续字符,直到它满足a、b或c。
例如,对于源字符串“qwerty qwerty whatever abc hello”,表达式将匹配到“qwerty-qwerty wh”。
但如果我希望匹配的字符串是“qwerty qwerty whatever”呢?
换句话说,我如何将所有内容都匹配到(但不包括)精确的序列“abc”?
当前回答
正如Jared Ng和@Issun所指出的,解决这种正则表达式的关键是“匹配某个单词或子字符串之前的所有内容”或“匹配某一单词或子串之后的所有内容。”。在这里阅读更多关于他们的信息。
在您的特定情况下,可以通过积极的展望来解决:.+?(?=abc)
一幅画胜过千言万语。请参见屏幕截图中的详细说明。
其他回答
你需要看看断言,比如.+?(?=abc)。
请参阅:零长度断言的前瞻性和滞后性
请注意[abc]与abc不同。在括号内,它不是一个字符串-每个字符只是一种可能性。在括号外,它成为字符串。
我想将sidyll的答案扩展到正则表达式的不区分大小写版本。
如果你想匹配abc/abc/abc。。。不区分大小写(我需要这样做),使用以下正则表达式。
.+?(?=(?i)abc)
说明:
(?i) - This will make the following abc match case insensitively.
正则表达式的另一种解释与sidyll指出的相同。
对于Java中的正则表达式,我也相信在大多数正则表达式引擎中,如果您想包括最后一部分,这将起作用:
.+?(abc)
例如,在这行中:
I have this very nice senabctence
选择“abc”之前的所有字符,并包括abc。
使用正则表达式,结果将是:我有一个非常好的senabc
测试一下:https://regex101.com/r/mX51ru/1
在Python中:
.+?(?=abc)适用于单线情况。
[^]+?(?=abc)不起作用,因为python无法将[^]识别为有效的正则表达式。要使多行匹配工作,需要使用re.DOTALL选项,例如:
re.findall('.+?(?=abc)', data, re.DOTALL)
这将对正则表达式有意义。
确切的单词可以从以下regex命令中获得:
("(.*?)")/g
在这里,我们可以得到属于双引号内的全局准确单词。
例如,如果我们的搜索文本是
这是“双引号”单词的示例
然后我们会从那句话中得到“双引号”。