- Java 双重比较
- java - 比较器与 Apache BeanComparator
- Objective-C 完成 block 导致额外的方法调用?
- database - RESTful URI 是否应该公开数据库主键?
我有包含以下结构的文本文档
{1,"StructEx",
[{1,"Element_1",[{2,"name","exampleName"},{3,"exampleValue",1},{2,"exampleComment","foo"}]},
[{1,"Element_2",[{2,"name","exampleName2"},{3,"exampleValue",2},{2,"exampleComment","bar"}]}]}
括号中的第一个值是数据类型。我需要将返回的正则表达式(通过几次迭代)StructEx 中的所有元素,因此我可以将其打包成这样
["StructEx"]=>
array(2) {
["Element_1"]=>
array(3) {
["name"]=>
string(11) "exampleName"
["exampleValue"]=>
int(1)
["exampleComment"]=>
string(3) "foo"
}
["Element_2"]=>
array(3) {
["name"]=>
string(12) "exampleName2"
["exampleValue"]=>
int(2)
["exampleComment"]=>
string(3) "bar"
}
}
最佳答案
假设嵌套是任意深度,那么答案是不,你不能用正则表达式解析这种文本文档。如果深度是有限的,这是痛苦的,但可行。
为了更详细地回答您的问题,让我们介绍一些很棒的干理论。
让我们将字母表 Σ 定义为一组非空符号(技术上更正确的定义来自范畴论,将字母表视为非空的自由对象,但为了论证,这个定义就足够了.
在我们的字母表 Σ 中,我们可以在字母表上定义一组所有有限字符串(读作:单词),即:
Σ = {s1, s2, ... ,sn}
Σ* = {ε} ∪ {si1si2...sim | sik ∈ Σ, m > 0, 1 ≤ k ≤ n}, where ε is an empty string
举个例子,这意味着如果我们有一个字母表 Σ = {a, b, c}
并且 Σ* 中的一些单词将是 aaaaaa
, abababa
,但不是 abd
,因为我们甚至不知道 d
存在。
给定字母表 Σ,我们有像 ab*|c
这样的正则表达式。我跳过了正则表达式的正式定义以减少混淆,所以让我们假设它是我们普通的老式“实用”正则表达式。
每个正则表达式都定义了一种正则语言,例如在此示例中,语言由单词 a
、ab
、c
、abbbbbc
组成,但不是 abc
。
每种常规语言都可以表示为 finite automaton ,一个可以识别正则表达式的设备。对于上述正则表达式 ab*|c
,自动机如下所示:
0 是开始状态,双圈是接受状态。简而言之,自动机从状态 0 开始消耗单词的每个字母并根据转换箭头移动。如果它最终处于接受状态,我们就说它接受 字符串。否则,我们说它拒绝它。
所以在这种情况下,将字符串 abb
送入我们的机器:
a
,进入状态1b
,进入状态3b
,进入状态3让我们看看当我们将 abc
送入我们的机器时会发生什么:
a
,进入状态1b
,进入状态3c
,无处可动,字符串被拒绝所以我们的正则表达式不匹配abc
。所有这些都与实用的正则表达式基本相同,只是增加了一些理论。
有一个定理表明每种正则语言都是有限自动机可识别的。这意味着,如果存在可以匹配您所需模式的正则语言(和底层正则表达式),则应该是一个等价的有限自动机。
但是您的模式中的嵌套深度是无限的。因此,你将需要一个无限大的有限自动机,它等价于正则语言,这与有限自动机的定义相矛盾。
如您所见,我跳过了正则表达式的归纳定义、范畴论角度的有限自动机、操作下的闭包以及其他一些正式内容。欢迎您在上述引用链接中阅读相关内容。
关于php - 用于提取嵌套元素的正则表达式,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/17596794/
我在为 MacOSX 构建的独立包中添加 DMG 背景的自定义图标时遇到问题。我在项目的根目录中添加了一个包。正在从中加载自定义图标,但没有加载 DMG 背景图标。我正在使用 Java fx 2.2.
Qt for Symbian 和 Qt for MeeGo 有什么区别?我知道 Qt 是一个交叉编译平台。这是否意味着如果我使用来自 Qt 的库,完全相同的库可以在所有支持 Qt 的设备(例如 Sym
我正在尝试使用 C# .NET 3.5/4.0 务实地运行 SQL Server 数据库的备份。我已经找到了如何完成此操作,但是我似乎找不到用于备份的命名空间库。 我正在寻找 Microsoft.Sq
我最近在疯狂学习 Java,但我通常是一名 .NET 开发人员。 (所以请原谅我的新手问题。) 在 .Net 中,我可以在不使用 IIS 的情况下开发 ASP.Net 页面,因为它有一个简化的 Web
这post仅当打印命令中有字符串时才有用。现在我有大量的源代码,其中包含一条声明,例如 print milk,butter 应该格式化为 print(milk,butter) 用\n 捕获行尾并不成功
所以我的问题是: https://gist.github.com/panSarin/4a221a0923927115584a 当我保存这个表格时,我收到了标题中的错误 NoMethodError (u
如何让 Html5 音频在点击时播放声音? (ogg 用于 Firefox 等浏览器,mp3 用于 chrome 等浏览器) 到目前为止,我可以通过 onclick 更改为单个文件类型,但我无法像在普
如果it1和it2有什么区别? std::set s; auto it1 = std::inserter(s, s.begin()); auto it2 = std::inserter(s, s.en
4.0.0 com.amkit myapp SpringMVCFirst
我目前使用 Eclipse 作为其他语言的 IDE,而且我习惯于不必离开 IDE 做任何事情 - 但是我真的很难为纯 ECMAScript-262 找到相同或类似的设置。 澄清一下,我不是在寻找 DO
我想将带有字符串数组的C# 结构发送到C++ 函数,该函数接受void * 作为c# 结构和char** 作为c# 结构字符串数组成员。 我能够将结构发送到 c++ 函数,但问题是,无法从 c++ 函
我正在使用动态创建的链接: 我想为f:param附加自定义转换器,以从#{name}等中删除空格。 但是f:param中没有转换器
是否可以利用Redis为.NET创建后写或直写式缓存?理想情况下,透明的高速缓存是由单个进程写入的,并且支持从数据库加载丢失的数据,并每隔一段时间持久保存脏块? 我已经搜查了好几个小时,也许是goog
我正在通过bash执行命令的ssh脚本。 FILENAMES=( "export_production_20200604.tgz" "export_production_log_2020060
我需要一个正则表达式来出现 0 到 7 个字母或 0 到 7 个数字。 例如:匹配:1234、asdbs 不匹配:123456789、absbsafsfsf、asf12 我尝试了([a-zA-Z]{0
我有一个用于会计期间的表格,该表格具有期间结束和开始的开始日期和结束日期。我使用此表来确定何时发生服务交易以及何时在查询中收集收入,例如... SELECT p.PeriodID, p.FiscalY
我很难为只接受字符或数字的 Laravel 构建正则表达式验证。它是这样的: 你好<-好的 123 <- 好的 你好123 <-不行 我现在的正则表达式是这样的:[A-Za-z]|[0-9]。 reg
您实际上会在 Repeater 上使用 OnItemDataBound 做什么? 最佳答案 “此事件为您提供在客户端显示数据项之前访问数据项的最后机会。引发此事件后,数据项将被清空,不再可用。” ~
我有一个 fragment 工作正常的项目,我正在使用 jeremyfeinstein 的 actionbarsherlock 和滑动菜单, 一切正常,但是当我想自定义左侧抽屉列表单元格时,出现异常
最近几天,我似乎平均分配时间在构建我的第一个应用程序和在这里发布问题!! 这是我的第一个应用程序,也是我们的设计师完成的第一个应用程序。我试图满足他所做的事情的外观和感觉,但我认为他没有做适当的事情。
我是一名优秀的程序员,十分优秀!