我试图使用grep来匹配包含两个不同字符串的行。我已经尝试了以下方法,但这匹配了包含不是我想要的string1或string2的行。

grep 'string1\|string2' filename

那么我如何匹配与grep只包含两个字符串的行?


当前回答

在任意位置搜索包含所有单词的任意顺序的文件:

grep -ril \'action\' | xargs grep -il \'model\' | xargs grep -il \'view_type\'

第一个grep启动递归搜索(r),忽略大小写(i)并列出(打印出)文件中任何地方出现的与(l)匹配的一个项(带有单引号的'action')的文件名。

后续的grep搜索其他术语,保留大小写不敏感并列出匹配文件。

您将获得的最终文件列表将是包含这些术语的文件,在文件的任何位置以任意顺序排列。

其他回答

当两个字符串按顺序排列时,在grep命令中放入一个模式:

$ grep -E "string1(?.*)string2" file

例如,在名为Dockerfile的文件中包含以下行:

FROM python:3.8 as build-python
FROM python:3.8-slim

要获取包含字符串的行:FROM python和as build-python,然后使用:

$ grep -E "FROM python:(?.*) as build-python" Dockerfile

然后输出将只显示包含这两个字符串的行:

FROM python:3.8 as build-python

你可以尝试这样做:

(pattern1.*pattern2|pattern2.*pattern1)

不要尝试使用grep,而是使用awk。为了匹配grep中的2个regexp R1和R2,你会认为它会是:

grep 'R1.*R2|R2.*R1'

而在awk中则是:

awk '/R1/ && /R2/'

但是如果R2和R1重叠或者是R1的子集呢?grep命令根本不起作用,而awk命令可以。假设你想找到包含and的行:

$ echo 'theatre' | grep 'the.*heat|heat.*the'
$ echo 'theatre' | awk '/the/ && /heat/'
theatre

你必须使用2个grep和一个管道:

$ echo 'theatre' | grep 'the' | grep 'heat'
theatre

当然,如果你真的需要它们是分开的,你总是可以在awk中编写与在grep中使用的相同的regexp,并且有其他的awk解决方案,不需要在每个可能的顺序中重复regexp。

撇开这个不谈,如果您想扩展您的解决方案以匹配3个regexp R1、R2和R3呢?在grep中,这是一个糟糕的选择:

grep 'R1.*R2.*R3|R1.*R3.*R2|R2.*R1.*R3|R2.*R3.*R1|R3.*R1.*R2|R3.*R2.*R1' file
grep R1 file | grep R2 | grep R3

而在awk中,它是简洁、明显、简单、高效的:

awk '/R1/ && /R2/ && /R3/'

现在,如果您实际上想匹配字面字符串S1和S2而不是正则表达式R1和R2呢?你不能在一次调用grep中就做到这一点,你必须在调用grep之前编写代码来转义所有的RE元字符:

S1=$(sed 's/[^^]/[&]/g; s/\^/\\^/g' <<< 'R1')
S2=$(sed 's/[^^]/[&]/g; s/\^/\\^/g' <<< 'R2')
grep 'S1.*S2|S2.*S1'

或者再次使用2个grep和一个管道:

grep -F 'S1' file | grep -F 'S2'

这也是糟糕的选择,而在awk中,您只需使用字符串操作符而不是regexp操作符:

awk 'index($0,S1) && index($0.S2)'

现在,如果您想在一个段落而不是一行中匹配2个regexp呢?不能在grep中完成,在awk中是微不足道的:

awk -v RS='' '/R1/ && /R2/'

那么跨整个文件呢?同样不能在grep中完成,在awk中是微不足道的(这次我使用GNU awk用于多字符RS,为了简洁,但在任何awk中都没有太多代码,或者你可以选择一个你知道不会在RS输入中的control-char来做同样的事情):

awk -v RS='^$' '/R1/ && /R2/'

因此,如果你想在一行、段落或文件中找到多个regexp或字符串,那么不要使用grep,使用awk。

对于多行匹配:

echo -e "test1\ntest2\ntest3" |tr -d '\n' |grep "test1.*test3"

or

echo -e "test1\ntest5\ntest3" >tst.txt
cat tst.txt |tr -d '\n' |grep "test1.*test3\|test3.*test1"

我们只需要删除换行符,它就工作了!

你的方法几乎很好,只是少了一个-w

grep -w 'string1\|string2' filename