- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我的环境:
os
和其他几个允许访问 native 文件系统、shell 命令或类似内容的包,因此所有功能必须在 Lua 本身(仅)中实现。我需要编写一个函数,如果输入字符串匹配任意字母和数字序列作为重复一次或多次的完整单词,则返回 true
,并且整个匹配子串的开头或结尾可能有标点符号。我在与 PCRE 词边界 \b
相同的意义上使用“整个词”。
为了证明这个想法,这里是使用 LuLpeg 的 re
模块的错误尝试;它似乎适用于负面前瞻,但不适用于背后:
function containsRepeatingWholeWord(input, word)
return re.match(input:gsub('[%a%p]+', ' %1 '), '%s*[^%s]^0{"' .. word .. '"}+[^%s]^0%s*') ~= nil
end
这里是示例字符串和预期的返回值(引号的语法就像输入到 Lua 解释器中一样,而不是字符串的文字部分;这样做是为了使尾随/前导空格明显):
"one !tvtvtv!two"
, word: tv
, 返回值: 真
“I'd”
,word: d
,返回值: 假
"tv"
,word: tv
,返回值: 真
"tvtv!"
,word: tv
,返回值: true
"epon"
,word: nope
,返回值: 错误
"eponnope "
,词: nope
,返回值: 错误
"atv"
,word: tv
,返回值: 错误
如果我有一个完整的 PCRE 正则表达式库,我可以快速完成此操作,但我没有,因为我无法链接到 C,而且我还没有找到任何 PCRE 或类似的纯 Lua 实现。
我不确定 LPEG 是否足够灵活(直接使用 LPEG 或通过它的 re
模块)来做我想做的事,但我很确定内置的 Lua 函数可以'不要做我想做的事,因为它不能处理重复的字符序列。 (tv)+
不适用于 Lua 的内置 string:match
函数和类似函数。
我一直在寻找有趣的资源以试图找出如何做到这一点,但无济于事:
最佳答案
我认为该模式不能可靠地工作,因为 %s*[^%s]^0
部分匹配一系列可选的空格字符,后跟非空格字符,然后它会尝试匹配重复的单词并失败。之后,它不会在字符串中向后或向前移动,并尝试在另一个位置匹配重复的单词。 LPeg 和 re
的语义与大多数正则表达式引擎的语义非常不同,即使对于看起来相似的事物也是如此。
这是一个基于re
的版本。该模式只有一个捕获(重复词),因此如果找到重复词,匹配将返回一个字符串而不是数字。
function f(str, word)
local patt = re.compile([[
match_global <- repeated / ( [%s%p] repeated / . )+
repeated <- { %word+ } (&[%s%p] / !.) ]],
{ word = word })
return type(patt:match(str)) == 'string'
end
它有点复杂,因为 Vanilla re
没有办法生成 lpeg.B
模式。
这是一个使用 lpeg.B
的 lpeg
版本。 LuLPeg 也适用于此。
local lpeg = require 'lpeg'
lpeg.locale(lpeg)
local function is_at_beginning(_, pos)
return pos == 1
end
function find_reduplicated_word(str, word)
local type, _ENV = type, math
local B, C, Cmt, P, V = lpeg.B, lpeg.C, lpeg.Cmt, lpeg.P, lpeg.V
local non_word = lpeg.space + lpeg.punct
local patt = P {
(V 'repeated' + 1)^1,
repeated = (B(non_word) + Cmt(true, is_at_beginning))
* C(P(word)^1)
* #(non_word + P(-1))
}
return type(patt:match(str)) == 'string'
end
for _, test in ipairs {
{ 'tvtv', true },
{ ' tvtv', true },
{ ' !tv', true },
{ 'atv', false },
{ 'tva', false },
{ 'gun tv', true },
{ '!tv', true },
} do
local str, expected = table.unpack(test)
local result = find_reduplicated_word(str, 'tv')
if result ~= expected then
print(result)
print(('"%s" should%s match but did%s')
:format(str, expected and "" or "n't", expected and "n't" or ""))
end
end
关于regex - 在 Lua 5.1 中将可重复字符串匹配为 "whole word",我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/54510033/
这个问题在这里已经有了答案: How to initialize var? (11 个答案) 关闭 8 年前。 我想给一个变量赋初值 null,并在下一个 if-else block 中赋值,但是编
我正在使用 TypeScript 3.8 编写 JS 和 TS 混合的代码。我写了以下行: export * as Easing from './easing'; 应该是 fair game在 Typ
我需要将 R 代码中的“/”更改为“\”。我有这样的事情: tmp <- paste(getwd(),"tmp.xls",sep="/") 所以我的 tmp是 c:/Study/tmp.xls 我希望
我有个问题。例如我有这个: id truth count 1 1 1 2 1 2 3 0 0 4 1 1 5 1 2 6 1
我正在尝试使用“IN”和“=”来查找一些 bean。我目前正在使用此代码: $ids = array(1,2,3,4); $user = 1; $things = R::find( 'thing'
是否可以在 Xcode 中部署到其他人的手机上?我没有 iPhone,但我想测试我在 friend 手机上制作的应用程序。在我支付 99 美元之前,我想确保这不会造成麻烦。 谢谢。 最佳答案 不会有任
我试图得到一个非常大的数字(超过 unsigned long long int )。所以我把它作为一个字符串,然后一个数字一个数字地转换成整数并使用它。 #include #include int
我在 Rust 中有 C 语言库的绑定(bind),但它们并不完整。 在 C 代码中,我定义了一个简化的宏,如下所示: #define MY_MACROS1(PTR) (((my_struct1
我正在努力解决这个问题。 http://jsfiddle.net/yhcqfy44/ 动画应该自动相对于 滚动到顶部每次出现滚动条时的高度。 我已经写了这个,但没有运气: var hheight =
我正在处理一个将数字作为字符串返回的 JSON API。例如 "12" ,但是,该字段值也可以是非数字的,例如:"-" . 我已将 JSON 数据解析为映射,我想将此字段提取为 elixir 中的整数
我正在尝试编写一个类,将.wav文件转换为.aiff文件作为项目的一部分。 我遇到了几个库Alvas.Audio(http://alvas.net/alvas.audio,overview.aspx)
我想在 Lucene 中将像“New York”这样的“复合词”索引为单个术语,而不是像“new”、“york”那样。这样,如果有人搜索“new place”,则包含“new york”的文档将不会匹
我希望这个解释能让我更好地了解使用宏的优点。 最佳答案 在函数中,所有参数在调用之前都会被评估。 这意味着 or 作为函数不能是惰性的,而宏可以将 or 重写为 if 语句,该语句仅在以下情况下计算分
我有一些看起来像这样的 XML foo ]]> (注意 > 登录 "> foo")和 XSLT 样式表 当我运行xsltproc stylesheet.xs
当我尝试将 Any 转换为 List 时,如下面的示例所示,我得到“Unchecked cast: Any!”到列表'警告。有没有解决此类问题的方法? val x: List = objectOfTy
我正在使用 Python 开发一个简单的爬虫。目的是创建一个 sitemap.xml。(你可以在这里找到真正的 alpha 版本:http://code.google.com/p/sitemappy/
我想知道在 VBScript 中是否可以在多行中中断 If 语句。喜欢: If (UCase(Trim(objSheet.Cells(i, a).Value)) = "YES") Or _ (UCas
for (String item : someList) { System.out.println(item); } 使用“do while”是否等效? 谢谢。 最佳答案 如果列表为空,f
这个问题已经有答案了: 已关闭10 年前。 Possible Duplicate: Split string with delimiters in C 在 C 中将“,”分隔的列表拆分为数组的最佳方法
我有一个如下所示的字符数组: [0, 10, 20, 30, 670] 如何将此字符串转换为整数数组? 这是我的数组 int i=0; size_t dim = 1; char* array = (c
我是一名优秀的程序员,十分优秀!