- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在尝试使用 regex 和 c 来搜索具有未知数量的组的给定模式。到目前为止,我所拥有的是:这是一种破坏性搜索(类似于strtok
)。我想要它做的是接受一个字符串,切掉正则表达式模式中给出的组例如,日期为 yyyymmdd([[:digit:]]{4})([[:digit:]]{2})([[:digit:]]{2}
)如果它在字符串中找到该模式,则提取出这些片段并用一些可识别的字符(可能是 \0
)将它们分开,并将它们存储到缓冲区中。完成此操作并提取所有组后,将原始字符串替换为缓冲区的内容。最后释放缓冲区占用的内存。
int search(char *string, char *pattern)
{
int status;
regex_t re;
size_t n_groups;
int begin, end, length;
char *match_text;
if(regcomp(&re, pattern, REG_EXTENDED) != 0)
{
return EXIT_SUCCESS;
}
n_groups = re.re_nsub + 1;
regmatch_t * groups = (regmatch_t*)malloc(n_groups * sizeof(regmatch_t));
if (groups == NULL)
{
fprintf(stderr, "Error allocating regex groups\n");
return EXIT_FAILURE;
}
status = regexec(&re, string, n_groups, groups, 0);
if(status != 0)
{
fprintf(stderr, "No matches found\n");
return EXIT_SUCCESS;
}
begin = groups[1].rm_so;
end = groups[1].rm_eo;
length = end - begin;
match_text = (char*)malloc(sizeof(char) * (length + 1));
if(match_text == NULL)
{
fprintf(stderr, "Error allocating %ld bytes\n", sizeof(char) * (length + 1));
exit(EXIT_FAILURE);
}
strncpy(match_text, string + begin, length);
match_text[length] = '\0';
regfree(&re);
/* Adjust size of string to contain matches */
string = (char*)realloc(string, (sizeof(char) * length+1));
if (string == NULL)
{
fprintf(stderr, "Error allocating %ld bytes\n", sizeof(char) * (length + 1));
return EXIT_FAILURE;
}
strncpy(string, match_text, length);
free(match_text);
return EXIT_SUCCESS;
}
现在,它正确找到了组数,并且似乎为缓冲区分配了正确的内存量。然后它替换原始字符串的内容。我如何让它捕获其他组并将它们分开?
提前谢谢您。
最佳答案
我似乎有一些正在发挥作用的东西。我不知道它是否“好”c,但它确实有效。
char* search(char *string, char *pattern)
{
regex_t compiled;
regmatch_t* groups;
size_t n_groups;
int begin, end, length, group, total_length;
char* match_text;
char* new_string;
if(regcomp(&compiled, pattern, REG_EXTENDED) != 0)
{
fprintf(stderr, "Could not compile regex\n");
return string;
}
n_groups = compiled.re_nsub + 1;
groups = (regmatch_t*)malloc(n_groups * sizeof(regmatch_t));
if(groups == NULL)
{
fprintf(stderr, "Error allocating regex groups\n");
return string;
}
if(regexec(&compiled, string, n_groups, groups,0 ) != 0)
{
fprintf(stderr, "No matches found\n");
return string;
}
total_length = (groups[0].rm_eo - groups[0].rm_so) ;
new_string = (char*)malloc(sizeof(char) * (total_length + 1));
if(new_string == NULL)
{
fprintf(stderr, "Error allocating %ld bytes\n",sizeof(char) * (total_length + 1) );
return NULL;
}
/* Clean new string*/
new_string[0] = '\0';
group = 1;
begin = groups[group].rm_so;
end = groups[group].rm_eo;
length = end - begin;
match_text = (char*)malloc(sizeof(char) * (length + 1));
if(match_text == NULL)
{
fprintf(stderr, "Error allocating %ld bytes\n",sizeof(char) * (total_length + 1) );
return NULL;
}
/* Clean new string*/
match_text[0] = '\0';
strncpy(match_text, string + begin, length);
match_text[length] = '\0';
new_string = append_string(new_string, match_text, "");
group++;
while (group < n_groups) {
begin= groups[group].rm_so;
end= groups[group].rm_eo;
length = end - begin;
match_text = (char*)malloc(sizeof(char) * (length + 1));
if(match_text == NULL)
{
fprintf(stderr, "Error allocating %ld bytes\n",sizeof(char) * (total_length + 1) );
return NULL;
}
match_text[0] = '\0';
strncpy(match_text, string + begin, length);
match_text[length] = '\0';
new_string = append_string(new_string, match_text, ",");
group++;
}
regfree(&compiled);
free(match_text);
return new_string;
}
我写了一个小辅助函数“append_string”
char* append_string(char* string, char* string2, char* sep)
{
char* new_string;
if((new_string = (char*)malloc(strlen(string) + strlen(string2) + strlen(sep)+ 1) ) == NULL)
{
fprintf(stderr, "Error appending strings" );
return NULL;
}
new_string[0] = '\0';
strcat(new_string, string);
strcat(new_string, sep);
strcat(new_string, string2);
return new_string;
}
关于C 正则表达式搜索和存储多个组,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/20322648/
我正在用 yacc/bison 编写一个简单的计算器。 表达式的语法看起来有点像这样: expr : NUM | expr '+' expr { $$ = $1 + $3; } | expr '-'
我开始学习 lambda 表达式,并在以下情况下遇到了以下语句: interface MyNumber { double getValue(); } MyNumber number; nu
这两个 Linq 查询有什么区别: var result = ResultLists().Where( c=> c.code == "abc").FirstOrDefault(); // vs. va
如果我们查看 draft C++ standard 5.1.2 Lambda 表达式 段 2 说(强调我的 future ): The evaluation of a lambda-expressio
我使用的是 Mule 4.2.2 运行时、studio 7.5.1 和 Oracle JDK 1.8.0_251。 我在 java 代码中使用 Lambda 表达式,该表达式由 java Invoke
我是 XPath 的新手。我有网页的html源 http://london.craigslist.co.uk/com/1233708939.html 现在我想从上面的页面中提取以下数据 完整日期 电子
已关闭。这个问题是 off-topic 。目前不接受答案。 想要改进这个问题吗? Update the question所以它是on-topic用于堆栈溢出。 已关闭10 年前。 Improve th
我将如何编写一个 Cron 表达式以在每天上午 8 点和下午 3:30 触发?我了解如何创建每天触发一次的表达式,而不是在多个设定时间触发。提前致谢 最佳答案 你应该只使用两行。 0 8 * * *
这个问题已经有答案了: What do 3 dots next to a parameter type mean in Java? (9 个回答) varargs and the '...' argu
我是 python 新手,在阅读 BeautifulSoup 教程时,我不明白这个表达式“[x for x in titles if x.findChildren()][:-1]”我不明白?你能解释一
(?:) 这是一个有效的 ruby 正则表达式,谁能告诉我它是什么意思? 谢谢 最佳答案 正如其他人所说,它被用作正则表达式的非捕获语法,但是,它也是正则表达式之外的有效 ruby 语法。 在
这个问题在这里已经有了答案: Why does ++[[]][+[]]+[+[]] return the string "10"? (10 个答案) 关闭 8 年前。 谁能帮我处理这个 JavaSc
这个问题在这里已经有了答案: What is the "-->" operator in C++? (29 个答案) Java: Prefix/postfix of increment/decrem
这个问题在这里已经有了答案: List comprehension vs. lambda + filter (16 个答案) 关闭 10 个月前。 我不确定我是否需要 lambda 或其他东西。但是,
C 中的 assert() 函数工作原理对我来说就像一片黑暗的森林。根据这里的答案https://stackoverflow.com/a/1571360 ,您可以使用以下构造将自定义消息输出到您的断言
在this页,John Barnes 写道: If the conditional expression is the argument of a type conversion then effec
我必须创建一个调度程序,它必须每周从第一天上午 9 点到第二天晚上 11 点 59 分运行 2 天(星期四和星期五)。为此,我需要提供一个 cron 表达式。 0-0 0-0 9-23 ? * THU
我正在尝试编写一个 Linq 表达式来检查派生类中的属性,但该列表由来自基类的成员组成。下面的示例代码。以“var list”开头的 Process 方法的第二行无法编译,但我不确定应该使用什么语法来
此 sed 表达式将输入字符串转换为两行输出字符串。两条输出行中的每一行都由输入的子串组成。第一行需要转换成大写: s:random_stuff\(choice1\|choice2\){\([^}]*
我正在使用 Quartz.Net 在我的应用程序中安排我的工作。我只是想知道是否可以为以下场景构建 CRON 表达式: Every second between 2:15AM and 5:20AM 最
我是一名优秀的程序员,十分优秀!