- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在通过我可以访问的两个单独的调试工具在字符串 AAAC
(来自 rexegg.com 的示例)上调试正则表达式 ^(A+)*B
:
下面是结果(左侧为 regex101):
我的问题主要不是步骤的数量(这对我来说也很重要),而是如何完成回溯。为什么我们会看到差异? (regex101使用PCRE lib,我将RegexBuddy lib设置为相同)
全面的逐步解释确实对我有利。
最佳答案
简而言之,“回溯”是指正则表达式引擎返回到“灵活”匹配,尝试不同的路径来获得成功的匹配。
例如,在以下模式和输入中:
foo(bar|baz)
foobaz
正则表达式引擎将匹配“foo”,然后尝试两个选项中的第一个,匹配“b”,然后匹配“a”,但在“r”处失败。不过,它不会让整个比赛失败,而是“倒带”并从第二个选择开始,匹配“b”,然后“a”,然后“z”......成功!
这也适用于量词。量词是鼓励引擎匹配重复模式的任何内容,包括 ?
、*
、+
和 {n,m}
(取决于引擎)。
贪婪量词(默认)将在继续模式的其余部分之前匹配尽可能多的重复。例如,给定以下模式和输入:
\w+bar
foobar
模式 \w+
将首先匹配整个字符串:“foobar”。但是,当它移至 b
时,正则表达式引擎已到达输入末尾,并且匹配失败。引擎不会简单地放弃,而是会要求最后一个贪婪量词放弃其中一个重复项,现在匹配“fooba”。匹配仍然失败,因此引擎要求 \w+
放弃“a”(失败),然后放弃“b”。放弃“b”后,引擎现在可以匹配bar
,并且匹配成功。
将正则表达式视为一棵“树”,回溯就是返回一个节点并尝试另一条路径。给定模式 foo(bar|baz)
和输入“foobaz”,引擎将尝试执行以下操作:
foo(bar|baz)
|\
| \
| : f (match)
| : o (match)
| : o (match)
| | (bar|baz)
| |\
| | \
| | : b (match)
| | : a (match)
| | : r (FAIL: go back up a level)
| | ^
| |\
| | \
| | : b (match)
| | : a (match)
| | : z (match)
| | /
| |/
| /
|/
SUCCESS
至于为什么你会看到回溯“数量”的差异......这可能与内部优化和日志记录级别有很大关系。例如,RegexBuddy 似乎没有将匹配记录到 ^
之前的空字符串,而 regex101 则记录了。不过,最终,只要最终得到相同的结果,回溯的确切顺序(爬回树上的顺序)并不重要。
您已经知道这一点,但为了其他碰巧遇到的人的利益,您的正则表达式被编写为演示“catastrophic backtracking”(又名“邪恶的正则表达式”),其中回溯尝试的次数随着输入增加。这些正则表达式可用于执行 DoS attacks ,因此您必须小心不要将它们引入到您的模式中(如 I found out )。
关于正则表达式调试,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/37912224/
昨晚我因为这个问题脑子崩溃了。在确保没有来 self 的 eclipse 错误检查的明显错误之后,我开始调试我的程序。顺便说一下,我正在使用 Jre7。无论如何,每次我进入我的类调用(我们称之为“a”
(前言:我对 C/C++ 还很陌生,我真的不知道 native 代码中的调试实际上是如何工作的。) 一些消息来源说 gdb 和 lldb 可以调试 any program compiled to ma
我正在尝试从 Visual Studio 2012 外部调试 T4Scaffolding.Core Nuget 包。我使用的是安装了 Powershell 3.0 的 Powershell ISE,并
如何调试汇编代码?我在 Linux 上使用 gdb。我知道我可以看寄存器。有哪些调试汇编代码的方法? 最佳答案 您当然可以使用 breakpoints就像 C 或任何其他编译语言一样。 This ar
如何在每次通话时打印列表或 haskell 中的内容,例如: funct a list = funct (a + 1) (a : list) print list her
让我用我对 Makefiles 或 make 知之甚少的评论作为这个问题的前缀。 有一个非常大的项目,每晚自动构建。它以 Debug 和 Release 模式构建,Debug 用于 Valgrind
我正在创建一个计算每周工资的程序,那么任何加类工资都是该周正常工资的 1.5 倍。我的代码如下: #include int main() { double payrate; double h
我使用的是 Visual Studio 2010 Express Developer 版本。开发网站。我在我的 .aspx 页面中使用 JavaScript。 如何在 Javascript 中放置断点
我最近开始修补 Project Euler 问题,并尝试用 Javascript 解决它们。这样做我往往会产生许多无限循环,现在我想知道是否有比终止 Firefox 或 Chrome 中的选项卡更好的
有没有办法在程序执行期间生成一个交互式 python 控制台(最好是 iPython)而不暂停主程序并且能够检查和修改程序变量?类似于浏览器为 JavaScript 提供的功能。 我知道 pdb.se
我正在使用 FFmpeg @ Android 并希望能够进入 FFmpeg 代码(Eclipse + Seqouya),同时编译 FFmpeg 我使用 --disable-stripping --en
我从使用互操作调用 win32 api 函数的 .net 进程中得到一个异常。 我有一个调试器,我想查看 LastError 的值。 是否可以从 Visual Studio 调试器中查看 LastEr
我正在尝试通过 VBA 创建一个宏,以在 IE 的多个选项卡中打开一组指定的链接。目前我正在使用下面的代码,如果我试图打开 3 个或更少的选项卡,它大部分时间都可以工作。任何超过 3 的代码都会在“N
好的,这似乎是一个愚蠢的问题,因为 MonoDevelop 越来越成熟,所以我确定我只是想念它,但我环顾四周,所有关于这个主题的问题似乎都是关于远程调试或 Mac 上的调试。 我使用的是 Ubuntu
如何调试 Rscripts是从命令行运行的? 我目前正在使用 getopt传递命令行选项的包,当有错误时,我很难: 看看到底出了什么问题; 在 R 中交互式调试(因为脚本需要命令行选项。) 有没有人有
支持 PDF 和网络上的信息很少。我碰巧在博客中看到一篇文章,提到 $.write() 或 $.writeln() 将向 javascript 控制台写入一个字符串。相当有用。有谁知道这个 $ 对象是
PyCharm 1.5 中是否可以使用 Firefox 和 Chrome 支持的 JavaScript 调试? 如果是这样,它能否与 Python/Django 调试器一起有效运行? 如果没有,有没有
我确定这以前发生在人们身上,某些东西在 Debug模式下工作,你在发布时编译,但有些东西坏了。 这发生在我在嵌入式 XP 环境中工作时,我发现最好的方法确实是编写一个日志文件来确定它会出错的地方。 您
我目前正在为即将到来的项目评估 Flow3。 AOP 模式和依赖注入(inject)将非常适合我们的目的。 现在我想不通的是如何在 Controller Action 中调试一些结果。 public
最初,我有一个包含测试服务器的 Django 应用程序。要调试此设置,我只需添加 import pdb; pdb.set_trace()代码中的任何位置,并且有一个断点将我扔到终端中的交互式调试器中(
我是一名优秀的程序员,十分优秀!