linux - 删除具有给定模式的特殊字符的行-6ren

linux - 删除具有给定模式的特殊字符的行

转载作者：塔克拉玛干更新时间：2023-11-02 23:38:37

24

4

我试图获取带有特殊字符的行，这些字符没有以 \ 为前缀。以下是特殊字符:

^$%.*+?!(){}[]|\

我需要在第 2 列中检查以上所有不以 \ 为前缀的特殊字符。我正在尝试用 awk 来完成这个，但没有运气。我想要如下输出。

输入.txt

1,ap^ple
2,o$range
3,bu+tter
4,gr(ape
5,sm\(ok\e
6,ra\in
7,p+la\\y
8,wor\+k

输出.txt

1,ap^ple
2,o$range
3,bu+tter
4,gr(ape
5,sm\(ok\e
6,ra\in
7,p+la\\y

第7行和第5行在output.txt因为有2个特殊字符(一个有反斜杠另一个没有反斜杠)

最佳答案

“最终”最终编辑:我想允许“\x”无论 x 是什么，但 OP 似乎不希望这样，所以我也修复了它。

在尝试找到一个“聪明”的正则表达式(它被“\\”或任何数量不正确的“\”阻塞，但显然对其余部分有效...)

我用 awk 重写了它，以“状态自动机”的方式完成:

想法:

如果在“正常模式”下，我们会遇到除“\”之外的特殊字符？ : 我们打印这条线! 如果在“正常模式”下，我们遇到一个“\”？ : 我们进入“转义模式”，在该模式下，忽略下一个字符 (但如果我们没有下一个字符，我们也需要打印该行!)

脚本:

awk -F"," '
  {
    IN_ESCAPED_MODE=0 ;
    for (i=1 ; i<=length($2) ; i++)
     {  char=substr($2,i,1)

        if ( IN_ESCAPED_MODE == 0)
     {  if ( index(".^$%*+?!(){}[]|",char) > 0 )
             {  print $0 ; break ;
             }

            if ( index("\\" , char ) > 0 )
             {  IN_ESCAPED_MODE=1 ; continue ;
             }
         }

        if ( IN_ESCAPED_MODE == 1)
     {   if ( index(".^$%*+?!(){}[]|\\",char) > 0 )
           {  IN_ESCAPED_MODE=0 ; continue ;
               }
             else
               {  IN_ESCAPED_MODE=0 ; print $0; break;
               }
         }
     }

    if (IN_ESCAPED_MODE == 1)
     {
        print $0 ; break ;
     }

  }
'  input.txt > output.txt

通过此更改，您将获得与 OP 相同的输出，例如当包含“\e”时打印一行...我觉得这很奇怪:对我来说“\e”很好，我们可以“逃避”什么？

有了那个输入:

1,ap^ple
2,o$range
3,bu+tter
4,gr(ape
5,sm\(ok\e
6,ra\in
7,p+la\\y
8,wor\+k

10,\
11,\\
12,\\\
13,.
14,\.
15,..
16,^
17,\^
18,$
19,\$
20,%
21,\%
22,*
23,\*
24,+
25,\+
26,?
27,\?
28,!
29,\!
30,(
31,\(
32,)
33,\)
34,{
35,\{
36,}
37,\}
38,[
39,\[
40,]
41,\]
42,|
43,\|

它输出:

1,ap^ple
2,o$range
3,bu+tter
4,gr(ape
5,sm\(ok\e
6,ra\in
7,p+la\\y
10,\
12,\\\
13,.
15,..
16,^
18,$
20,%
22,*
24,+
26,?
28,!
30,(
32,)
34,{
36,}
38,[
40,]
42,|

(看来这次真的有用了!)

如果您更愿意允许任何 "\x"而不仅仅是 "x"是一个特殊字符:

改变“中间线”:

        if ( IN_ESCAPED_MODE == 1)
         {  if ( index(".^$%*+?!(){}[]|\\",char) > 0 )
             {  IN_ESCAPED_MODE=0 ; continue ;
             }
            else
             {  IN_ESCAPED_MODE=0 ; print $0; break;
             }
         }

进入:

        if ( IN_ESCAPED_MODE == 1)
         {  IN_ESCAPED_MODE=0 ; continue ;
         }

出于历史原因:正则表达式(在“大多数”情况下有效，但在某些情况下会阻塞，例如，如果有“\\”):

 egrep '[^\][].^$%*+?!(){}[|]|[^\][\][^].^$%*+?!(){}[|\]'   input.txt > output.txt

但是那个不会显示第12行，例如...

关于linux - 删除具有给定模式的特殊字符的行，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/20633351/

24

4

0

文章推荐： c++ - 链接器可以报告未使用的成员函数吗？ (C++)(海合会)

文章推荐： android - 更改 ListView 项目的文本颜色

文章推荐： c++ - apache 服务器上的 fcgi 与 mod_fastcgi

文章推荐：安卓图像魔术

java - 查看端口问题中的元素[特殊]
我以一种特殊的方式收到以下错误。 The point at which the driver is attempting to click on the element was not scrolle
java - “特殊” APP用例
我有一些包含如下方法的编译库： public boolean foo(String userID) { Class ntSystemClass = Thread.currentThread()
MySQL 特殊 ORDER BY
假设我有下表 name | genre --------------------- book 1 | scifi book 2 | horror book 3
ios - 特殊 - 字符串中的汉字
我正在用代码进行语言翻译。 self.title.text = [NSString stringWithFormat:NSLocalizedString(@"Q%ld", nil), (long)qu
r - 询问〜特殊〜并返回答案的函数
我想这样做，但到目前为止，我所拥有的只是: print("Will you go out with me?") 我希望代码能够正常工作，以便人们可以回答“是/否”，如果回答是"is"，则将返回一条消息
c# - 特殊 HTML 字符
这个问题在这里已经有了答案: 关闭 11 年前。 Possible Duplicate: How can I decode html characters in c#? 我有来自 HTML 的字符，
javascript - 特殊 ucwords 的正则表达式
我想在 JavaScript 中对以下形式的字符串执行 ucwords()，它应该返回 Test1_Test2_Test3。我已经在 SO 上找到了一个 ucwords 函数，但它只需要空格作为新词
javascript - 两个数组的求和\相加(特殊)
“任何长度的正数表示为数字字符数组，因此介于‘0’和‘9’之间。我们知道最重要的密码位于数组索引 0 的位置。例子: - 号码是 10282 - 数组将是数字 = [1,0,2,8,2] 考虑到这一
Android 特殊 Unicode 字符
我目前正在开发一个显示特殊 unicode 字符(例如 ꁴ)的应用现在我遇到了在旧设备上无法显示这些符号的问题。我如何知道它是否适用于当前设备？我是否必须为每个 SDK 版本创建一个虚拟 Andr
html - 特殊 HTML 构造标签的名称
在 HTML、XML 和部分 DTD 中，有两种特殊的标记结构: 以感叹号开头的标签结束，例如和以问号开头的标签，例如和我的问题是，这些构造类型中的每一种是否都有不同的名称，或者我是否必
Python stdout 重定向(特殊)
我目前正在用 python 构建一个 shell。shell 可以执行 python 文件，但我还需要添加使用 PIPE 的选项(例如“|”表示第一个命令的输出将是第二个命令的输入)。为了做到这一点
c# - 特殊 MVC 路由不起作用
我的 MVC 项目中的路由无法正常工作... 我希望我所有的 View 都在 Views > Shared 文件夹中，如下所示: Error.cshtml (default) Index.cshtml
Java - 特殊 URL 字符
我有一个函数: public static ImageIcon GetIconImageFromResource(String path){ URL url = ARMMain.class.g
html - 特殊 HTML 字符
好的，所以我想在我的 html 页面中包含下面的字符。看起来很简单，只是我找不到它们的 HTML 编码。注意:我想在没有大小元素的情况下执行此操作，纯文本就可以了 ^_^。干杯。最佳答案你可以
java - 特殊 Java 注释标签的完整列表
关闭。这个问题不符合Stack Overflow guidelines .它目前不接受答案。我们不允许提问寻求书籍、工具、软件库等的推荐。您可以编辑问题，以便用事实和引用来回答。关闭 3 年前。
c# - 特殊(或外国)字符
我是 C# 的新手，正在尝试使用 ASP.Net GridView(框架 3.5)，当 gridView 文本包含以下内容时，我发现了一个大问题: ñ/Ñ/á/Á/é/É/í/Í/ó/Ó/ú/Ú or
特殊 URL 的 Java 正则表达式
在 Java 中，我尝试编写一个正则表达式来匹配特殊类型的 HTTP URL: http:///# 所以字符串有 4 段: 字符串文字:“http://”；那么任意 1 个以上字符的字符串；那么字
mysql 有内部(特殊)字 "to"吗？
当我写查询时，我在表中有“to”列 SELECT to FROM mytable mysql_error 返回错误，如果将单词to插入``引号，即 SELECT `to` FROM mytable 查
python - 匹配大写/特殊/unicode/越南字符的正则表达式
我遇到了一个问题。事实上，我使用越南语文本，我想找到每个包含大写字母(大写字母)的单词。当我使用“re”模块时，我的函数 (temp) 没有捕捉到像“Đà”这样的词。另一种方法 (temp2) 是一次
python - 替换多个(特殊)字符 - 最有效的方法？
在我的文本中，我想用一个空格替换以下特殊字符: symbols = ["`", "~", "!", "@", "#", "$", "%", "^", "&", "*", "(", ")", "_",

首页

博学

6Ren·AI

商城

linux - 删除具有给定模式的特殊字符的行