- Java 双重比较
- java - 比较器与 Apache BeanComparator
- Objective-C 完成 block 导致额外的方法调用?
- database - RESTful URI 是否应该公开数据库主键?
我试图在每个分号后插入一个空格,除非分号是 HTML 实体的一部分。这里的示例很短,但我的字符串可能很长,有几个分号(或没有)。
Coca‑Cola => Coca‑Cola (‑ is a non-breaking hyphen)
Beverage;Food;Music => Beverage; Food; Music
我发现以下正则表达式可以处理短字符串:
<?php
$a[] = 'Coca‑Cola';
$a[] = 'Beverage;Food;Music';
$regexp = '/(?:&#?\w+;|[^;])+/';
foreach ($a as $str) {
echo ltrim(preg_replace($regexp, ' $0', $str)).'<br>';
}
?>
但是,如果字符串有点大,上面的 preg_replace
实际上会使我的 Apache 服务器崩溃(与服务器的连接在页面加载时被重置。)将以下内容添加到上面的示例代码中:
$a[] = 'Lorem ipsum dolor sit amet, consectetur adipiscing elit. '.
'In blandit metus arcu. Fusce eu orci nulla, in interdum risus. '.
'Maecenas ut velit turpis, eu pretium libero. Integer molestie '.
'faucibus magna sagittis posuere. Morbi volutpat luctus turpis, '.
'in pretium augue pellentesque quis. Cras tempor, sem suscipit '.
'dapibus lacinia, dolor sapien ultrices est, eget laoreet nibh '.
'ligula at massa. Cum sociis natoque penatibus et magnis dis '.
'parturient montes, nascetur ridiculus mus. Phasellus nulla '.
'dolor, placerat non sem. Proin tempor tempus erat, facilisis '.
'euismod lectus pharetra vel. Etiam faucibus, lectus a '.
'scelerisque dignissim, odio turpis commodo massa, vitae '.
'tincidunt ante sapien non neque. Proin eleifend, lacus et '.
'luctus pellentesque;odio felis.';
上面的代码(带有大字符串)使 Apache 崩溃,但如果我在命令行上运行 PHP 则可以正常工作。
在我的程序的其他地方,我在更大的字符串上使用 preg_replace
没有问题,所以我猜测正则表达式中的某些东西压倒了 PHP/Apache。
那么,有没有一种方法可以“修复”正则表达式,使其在 Apache 上使用大字符串工作,或者是否有另一种更安全的方法来做到这一点?
如果有任何帮助,我在 Windows XP SP3 上使用 PHP 5.2.17 和 Apache 2.0.64。 (不幸的是,目前无法升级 PHP 或 Apache。)
最佳答案
我会建议这个匹配表达式:
\b(?<!&)(?<!&#)\w+;
...匹配一系列字符(字母、数字和下划线),其前面没有 & 符号(或 & 符号后跟哈希符号)但后面有分号。
它分解为:
\b # assert that this is a word boundary
(?<! # look behind and assert that you cannot match
& # an ampersand
) # end lookbehind
(?<! # look behind and assert that you cannot match
&# # an ampersand followed by a hash symbol
) # end lookbehind
\w+ # match one or more word characters
; # match a semicolon
替换为字符串'$0'
如果这对你不起作用,请告诉我
当然,你也可以使用 [a-zA-Z0-9]
而不是 \w
来避免匹配分号,但我不认为永远不会给你带来任何麻烦
此外,您可能还需要转义散列符号(因为这是正则表达式注释符号),如下所示:
\b(?<!&)(?<!&\#)\w+;
编辑 不确定,但我猜测将单词边界放在开头会使它更有效率(因此不太可能使您的服务器崩溃),所以我改变了在表达式和分解中...
EDIT 2 ... 以及有关您的表达式可能导致服务器崩溃的原因的更多信息:Catastrophic Backtracking -- 我认为这适用(?)嗯……不过还是不错的信息
FINAL EDIT 如果您只想在分号后添加一个空格如果后面没有空格(即在 的情况下添加一个pellentesque;odio
但在 pellentesque; odio
的情况下不是),然后在末尾添加额外的前瞻性,这将防止添加额外的不必要的空格:
\b(?<!&)(?<!&\#)\w+;(?!\s)
关于php - 在分号后插入空格,除非它是 HTML 实体的一部分,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/10018897/
我有 512 行要插入到数据库中。我想知道提交多个插入内容是否比提交一个大插入内容有任何优势。例如 1x 512 行插入 -- INSERT INTO mydb.mytable (id, phonen
已经提出了类似的问题,但由于它总是取决于,我单独询问我的具体情况。 我有一个网站页面,显示来自数据库的一些数据,要从该数据库生成数据,我必须执行一些相当复杂的多连接查询。 数据每天(每晚)更新一次。
我正在使用 MongoDb 和 MySQL 的 python 连接器 pymongo 和 pymysql 测试 MongoDb 和 MySQL,特别是插入功能。 pymongo版本是3.4,pymys
从 C# 应用程序插入大型数组(10M 元素)的最快方法是什么? 到目前为止,我使用的是批量插入。 C# 应用程序生成一个大文本文件,我使用 BULK INSERT 命令加载它。出于好奇,我编写了一个
我编写了一个枚举类型,当我为它运行我创建的 JUnit 测试时会出现以下语法错误: java.lang.Error: Unresolved compilation problems: Synt
我正在尝试创建一个程序,它将单词列表作为输入,并将它们排序为二叉树,以便能够找到它们,例如像字典。这是我到目前为止所做的,但是 newEl -> el = input; 出现段错误,我知道这是因为它试
你好 我有编译这个问题 \begin{equation} J = \sum_{j=1}^{C} \end{equation} 我不断收到错误 missing $ inserted 这很奇怪,因
我需要使用 LINQ to SQL 将记录插入到没有主键的表中。 table 设计得很差;我无法控制表结构。该表由几个 varchar 字段、一个文本字段和一个时间戳组成。它用作其他实体的审计跟踪。
我正在尝试使用 itextsharp 创建 Pdf。我添加了一张包含两列的表格,其中一列包含文本和其他图像。我想要恒定的图像大小 如果另一个单元格中的文本增加并且其他单元格中的图像大小不同,我的图像会
我想把 calory 作为 fruits 的第一个值,我做不到,有人能帮忙吗? $sql = 'INSERT INTO fruits VALUES('', ?, ?, ?)'
我有一个包含季度观察结果的 data.frame。我现在想插入每月值(首选三次,线性很好)。中间目标应该是使用 DATE 创建一个 data.frame作为所有每月观察的索引和缺失值。 谷歌搜索表明我
我想知道是否有办法在值列表中使用“插入”。我正在尝试这样做: insert into tblMyTable (Col1, Col2, Col3) values('value1', value
我想让人们能够在他们的网站中插入单个 Javascript 行,这实际上允许我插入包含我网站内容的固定大小的 IFRAME。它实际上是一个小部件,允许他们搜索我的网站或接收其他信息。这可能吗? 最佳答
我有一个包含时间的表,列名为 time,数据类型为 Date。 在 asp.net 中,我想要一个查询插入日期,另一个查询则在 2 个日期之间进行选择。 我已经尝试过这个: string data =
这是我的代码: create or replace trigger th after insert on stock for each row declare sqty number;
这是一个带有具体示例的通用问题。 我有一个包含三个字段(流派 ID (PK IDENTITY)、流派和子流派)的表。该表对(流派,子流派)组合具有唯一约束。 我想知道如何修改存储过程以在表中不存在时插
因此,我正在遍历二叉树,节点包含字符串,以及读取文件时该字符串是否出现多次。我只查找读取文件时出现次数最多的前 10 个单词,因此本质上我只是比较 int 值。 我的问题是我正在尝试找出一种有效的方法
我有一张机票和行李 map , 每张门票必须是唯一的,并且必须与 map 上的位置相对应 是否可以仅更改行李(m_bagage->秒)而不更改 key ? std::unordered_map m_c
我正在使用 jdbc 驱动程序做一个示例项目。我的问题是,如果我在 2 文本字段中输入空值。 null 不应该加载到数据库中吗?有没有办法避免在数据库中插入空字段?任何帮助将不胜感激。 //Execu
我想知道 SSIS 中是否有特定的插入或更新选项。 如果我想让程序检查它是更新还是插入,我是否必须做一些编码?或者是否可以启用一个选项,以便它会自行检查 PK 是否存在,然后更新,否则插入? 亲切的问
我是一名优秀的程序员,十分优秀!