Shell命令查找两个文件中的公共行

我确信我曾经发现过一个shell命令，它可以从两个或多个文件中打印公共行。它叫什么名字?

它比diff简单多了。

当前回答

perl -ne 'print if ($seen{$_} .= @ARGV) =~ /10$/'  file1 file2

2013-07-17 15:05:36

其他回答

perl -ne 'print if ($seen{$_} .= @ARGV) =~ /10$/'  file1 file2

2013-07-17 15:05:36

而

fgrep -v -f 1.txt 2.txt > 3.txt

给出了两个文件的区别(在2.txt和不在1.txt中的文件)，你可以很容易地做一个

fgrep -f 1.txt 2.txt > 3.txt

收集所有公共行，这应该为您的问题提供一个简单的解决方案。如果你已经对文件进行了排序，你仍然应该使用通信。的问候!

注意:你可以用grep -F代替fgrep。

2015-01-20 17:21:16

rm file3.txt

cat file1.out | while read line1
do
        cat file2.out | while read line2
        do
                if [[ $line1 == $line2 ]]; then
                        echo $line1 >>file3.out
                fi
        done
done

这个应该可以了。

2013-09-01 09:34:41

为了补充Perl的一行代码，下面是它在awk中的等价代码:

awk 'NR==FNR{arr[$0];next} $0 in arr' file1 file2

这将把file1中的所有行读入数组arr[]，然后检查file2中的每一行是否已经存在于数组中(即file1)。找到的行将按照它们在file2中出现的顺序打印出来。请注意，arr中的比较使用从file2开始的整行作为数组的索引，因此它只报告整行上的精确匹配。

2014-10-11 21:50:39

有关如何为多个文件执行此操作，请参阅跨多个文件查找匹配行的链接答案。

结合这两个答案(答案1和答案2)，我认为你可以得到你需要的结果，而不需要对文件进行排序:

#!/bin/bash
ans="matching_lines"

for file1 in *
do 
    for file2 in *
        do 
            if  [ "$file1" != "$ans" ] && [ "$file2" != "$ans" ] && [ "$file1" != "$file2" ] ; then
                echo "Comparing: $file1 $file2 ..." >> $ans
                perl -ne 'print if ($seen{$_} .= @ARGV) =~ /10$/' $file1 $file2 >> $ans
            fi
         done 
done

只需保存它，赋予它执行权限(chmod +x compareFiles.sh)并运行它。它将获取当前工作目录中的所有文件，并进行all-vs-all比较，将结果留在“matching_lines”文件中。

需要改进的地方:

跳过目录避免将所有文件进行两次比较(file1 vs file2和file2 vs file1)。可以在匹配的字符串旁边添加行号

2013-11-08 14:33:07

Shell命令查找两个文件中的公共行

推荐文章

最新文章

标签