- iOS/Objective-C 元类和类别
- objective-c - -1001 错误,当 NSURLSession 通过 httpproxy 和/etc/hosts
- java - 使用网络类获取 url 地址
- ios - 推送通知中不播放声音
tl;dr 有没有办法在 Java 中将任意正则表达式或/组合成一个正则表达式(用于匹配,而不是捕获)?
在我的应用程序中,我收到了来自用户的两个列表:
我需要输出 (2) 中与 (1) 中的任何正则表达式都不匹配的字符串列表。
我有一个明显的简单实现(遍历 (2) 中的所有字符串;对于每个字符串遍历 (1) 中的所有模式;如果没有模式匹配该字符串,则将其添加到将返回的列表中)但是我想知道是否可以将所有模式组合成一个模式并让正则表达式编译器利用优化机会。
OR 组合正则表达式的明显方法显然是 (regex1)|(regex2)|(regex3)|...|(regexN)
但我很确定这不是正确的考虑到我无法控制各个正则表达式(例如,它们可能包含所有方式的后退/前向引用)。因此,我想知道您是否可以建议一种在 Java 中组合任意正则表达式的更好方法。
注意:上面仅暗示了这一点,但我会明确说明:我只匹配字符串 - 我不需要使用捕获组的输出。
最佳答案
一些正则表达式引擎(例如 PCRE)具有结构 (?|...)
.它就像一个非捕获组,但具有一个很好的特性,即在每个交替组中都从相同的初始值开始计数。这可能会立即解决您的问题。因此,如果您可以选择为此任务切换语言,那应该可以解决问题。
[编辑:事实上,它仍然会导致冲突命名捕获组的问题。事实上,该模式甚至无法编译,因为组名无法重用。]
否则您将不得不操纵输入模式。 hyde 建议对反向引用重新编号,但我认为有一个更简单的选择:将所有组命名为组。您可以向自己保证这些名称是唯一的。
基本上,对于每个输入模式,您都会创建一个唯一标识符(例如,增加一个 ID)。然后最棘手的部分是在模式中找到捕获组。您将无法使用正则表达式执行此操作。您将不得不自己解析模式。如果您只是简单地遍历模式字符串,这里有一些关于需要注意什么的想法:
?:
的左括号, ?=
, ?!
, ?<=
, ?<!
, ?>
.另外还有选项设置括号:(?idmsuxU-idmsuxU)
或 (?idmsux-idmsux:somePatternHere)
它也没有捕获任何内容(当然可以有这些选项的任何子集,它们可以按任何顺序排列 - -
也是可选的)。(?<name>
.最简单的方法可能是对它们一视同仁——也就是说,同时拥有一个数字和一个名称(如果未设置名称,则名称等于数字)。然后你用类似 (?<uniqueIdentifier-md5hashOfName>
的东西重写所有这些(连字符实际上不能是名称的一部分,您只会在递增的数字后跟散列 - 因为散列的长度是固定的,所以不会有任何重复;至少差不多)。请务必记住该组最初的编号和名称。k<name>
其中 name
是您为群组生成的新群组名称。k<...>
.再次将其替换为相应的新名称。一旦你对每个输入模式都完成了这个,你就可以安全地将它们与 |
组合起来。 .反向引用以外的任何其他功能都不应该导致此方法出现问题。至少只要您的模式有效就不会。当然,如果你有输入a(b
和 c)d
那你就有问题了。但是,如果您不检查模式是否可以自行编译,您将始终拥有它。
我希望这能为您指明正确的方向。
关于java - 组合 (OR) 任意正则表达式,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/13890416/
我有一个 mysql 表,其中包含一些随机数字组合。为简单起见,以下表为例: index|n1|n2|n3 1 1 2 3 2 4 10 32 3 3 10 4 4
我有以下代码: SELECT sdd.sd_doc_classification, sdd.sd_title, sdd.sd_desc, sdr.sd_upl
如果我有两个要合并的数据框 Date RollingSTD 01/06/2012 0.16 01/07/2012 0.18 01/08/2012 0.17 01/09/20
我知道可以使用 lein ring war 创建一个 war 文件,但它似乎仍然包含码头依赖项。当我构建 war (并在 tomcat 上部署)时,有没有办法排除码头依赖项? 如果我根本不能做这件事,
维基百科关于封装的文章指出: “封装还通过防止用户将组件的内部数据设置为无效或不一致的状态来保护组件的完整性” 我在一个论坛上开始讨论封装,在那里我问你是否应该始终在 setter 和/或 gette
对于我使用的组合框内的复选框: AOEDComboAssociationName = new Ext.form.ComboBox({ id: 'AOEDComboAssociationName',
这个问题在这里已经有了答案: 关闭 10 年前。 Possible Duplicate: How do I combine LINQ expressions into one? public boo
如何在 rust 中找到排列或组合的数量? 例如C(10,6) = 210 我在标准库中找不到这个函数,也找不到那里的阶乘运算符(这就足够了)。 最佳答案 以@vallentin 的回答为基础,可以进
我有一个复杂的泛型类型用例,已在下面进行了简化 trait A class AB extends A{ val v = 10 } trait X[T<:A]{ def request: T }
如何使用 Hibernate 限制来实现此目的? (((A='X') and (B in('X',Y))) or ((A='Y') and (B='Z'))) 最佳答案 思考有效 Criteria c
我一定会在我的一个项目中使用谷歌图表。我需要的是,显示一个条形图,并且在条形图中,与每个条形相交的线代表另一个值。如果您查看下面的 jsfiddle,您会发现折线图仅与中间的条形图相交,并继续向其他条
只是一个简单的问题,我也很想得到答案,因为我不能百分百理解 Javascript 示例:假设您提示用户输入名称。够简单吧?但是你有一个数组,上面写着一些名字(其中之一就是),基本上就是我到目前为止所说
我试图通过 Haskell 理解函数式编程,但在处理函数组合时遇到了很多麻烦。 其实我有这两个功能: add:: Integer -> Integer -> Integer add x y = x
我正在寻找一种在 Realm 查询中组合 AND 和 OR 的方法。 这是我的课: class Event extends RealmObject { String id; String
例如,我有一个包含 5 个元素的哈希: my_hash = {a: 'qwe', b: 'zcx', c: 'dss', d: 'ccc', e: 'www' } 我的目标是每次循环哈希时都返回,但没
我是Combine 的新手,我想得到一个看似简单的东西。假设我有一个整数集合,例如: let myCollection = [0, 1, 2, 3, 4, 5, 6, 7, 8, 9] 我想以例如 0
关于“优先组合而不是继承”的问题,我的老师是这样说的: 组合:现有类成为新类的组件 转发:新类中的每个实例方法,在现有类的包含实例上调用相应的方法并返回结果 包装器:新类封装了现有的 这三个概念我不是
我正在尝试将单个整数从 ASCII 值转换为 0 和 1。相关代码如下所示: int num1 = bin.charAt(0); int num2 = bin.charAt(1);
这个问题已经有答案了: What is a NullPointerException, and how do I fix it? (12 个回答) 已关闭 7 年前。 我经常看到“嵌套”类中的非静态变
我尝试合并两个数据集(DataFrame),如下所示: D1 = pd.DataFrame({'Village':['Ampil','Ampil','Ampil','Bachey','Bachey',
我是一名优秀的程序员,十分优秀!