什么是正则表达式中的非捕获组？

如何在正则表达式中使用非捕获组，即（？：），它们有什么好处？

当前回答

（？：…）充当一个组（…），但不捕获匹配的数据。它确实比标准的捕获组效率高得多。当你想对某个东西进行分组，但以后不需要重用它时，就可以使用它了@托托

2021-04-24 10:43:08

其他回答

历史动机：

非捕获组的存在可以用括号来解释。

考虑表达式（a|b）c和a|bc，由于串联优先于|，这些表达式分别表示两种不同的语言（{ac，bc}和{a，bc}）。

然而，括号也用作匹配组（如其他答案所解释的…）。

当您想有括号但不想捕获子表达式时，可以使用NON-CAPTURING GROUPS。在示例中，（？：a|b）c

2016-02-04 08:07:28

您可以使用捕获组来组织和分析表达式。非捕获组具有第一个好处，但没有第二个好处的开销。例如，您仍然可以说非捕获组是可选的。

假设你想匹配数字文本，但有些数字可以写成1、2、3、4，。。。如果要捕获数字部分，而不是（可选）后缀，则可以使用非捕获组。

([0-9]+)(?:st|nd|rd|th)?

这将匹配形式1、2、3…或形式1、第2、第3…的数字，。。。但它将只捕获数字部分。

2010-08-18 13:24:36

为了补充本主题中的其他好答案，我想添加一个有趣的观察结果。

查找：您可以在非捕获组中包含捕获组。

问题详细信息：请查看下面匹配web URL的正则表达式：

var parse_url_regex = /^(?:([A-Za-z]+):)(\/{0,3})([0-9.\-A-Za-z]+)(?::(\d+))?(?:\/([^?#]*))?(?:\?([^#]*))?(?:#(.*))?$/;

以下是我的输入url字符串：

var url = "http://www.ora.com:80/goodparts?q#fragment";

正则表达式中的第一个组（？：（[A-Za-z]+）：）是一个非捕获组，它匹配协议方案（http）和冒号（：）字符。继续，它变为http:。但当我运行以下代码时：

console.debug(parse_url_regex.exec(url));

我可以看到返回数组的第一个索引包含字符串http（请参阅屏幕截图）。

此时，我的想法是http和冒号：两者都不会在输出中报告，因为它们位于非捕获组中。如果第一个正则表达式组（？：（[A-Za-z]+）：）是非捕获组，那么为什么它在输出数组中返回http字符串？

解释：如果你注意到，（[A-Za-z]+）是一个捕获组（开头没有？）。但这个捕获组本身位于一个非捕获组（？：（[a-Za-z]+）：）内，后面跟着一个：字符。这就是为什么文本http仍然被捕获，但冒号：字符落在非捕获组内（但在捕获组外），不会在输出数组中报告。

2017-07-15 03:13:01

我想我会给你答案。在未检查匹配是否成功的情况下，不要使用捕获变量。

除非匹配成功，否则捕获变量$1等无效，并且它们也不会被清除。

#!/usr/bin/perl  
use warnings;
use strict;   
$_ = "bronto saurus burger";
if (/(?:bronto)? saurus (steak|burger)/)
{
    print "Fred wants a  $1";
}
else
{
    print "Fred dont wants a $1 $2";
}

在上面的示例中，为了避免在$1中捕获bronto，使用了（？：）。

如果模式匹配，则$1被捕获为下一个分组模式。

因此，输出如下：

Fred wants a burger

如果不希望保存匹配项，则此选项很有用。

2017-05-23 13:40:43

?: 当您想对表达式进行分组，但不想将其保存为字符串的匹配/捕获部分时，使用。

一个例子是匹配IP地址：

/(?:\d{1,3}\.){3}\d{1,3}/

请注意，我不在乎保存前3个八位字节，但（？：…）分组允许我缩短正则表达式，而不会导致捕获和存储匹配项的开销。

2010-08-18 13:22:05

什么是正则表达式中的非捕获组？

推荐文章

最新文章

标签