python - 对 2 个文本执行差异，仅使用文本中每一行的一部分-6ren

python - 对 2 个文本执行差异，仅使用文本中每一行的一部分

转载作者：塔克拉玛干更新时间：2023-11-03 05:24:57

26

4

我有两个文本。

T0 ID A
T1 ID B
T2 ID C
T4 ID D

和

T5 ID A
T6 ID E
T7 ID F
T8 ID D

我真的只对比较 ID 字母序列的差异感兴趣。但是我想在输出中保留每个元素的第一部分，这样我以后可以将它用于其他分析，即输出看起来像这样

@-1,2 +1,2
-T2 ID B
-T3 ID C
+T6 ID E
+T7 ID F

进行这种比较的最佳方法是什么？理想情况下使用 difflib python 库。

此外，我有 2 个对象列表，而不是 2 个文本，每个对象都有 2 个属性(object.t 返回 T1，object.ID 返回 B)，我只想对对象列表执行差异关于他们的 ID 属性。我可以执行这样的操作吗？也许这应该是一个不同的问题。

谢谢

最佳答案

你可以创建一个 str 的子类来散列和比较，就像它只包含它的 ID 一样:

import re

class IdString(str):
    """A string that hashes and compares on its id.

        >>> hash(IdString('XXX ID A XXX')) == hash('A')
        True
        >>> hash(IdString('XXX ID abc XXX')) == hash('abc')
        True
        >>> IdString('XXX ID A XXX') == IdString('YYY ID A YYY')
        True
        >>> IdString('XXX ID A XXX') == IdString('XXX ID B XXX')
        False

    """
    def __new__(cls, *args):
        self = super(IdString, cls).__new__(cls, *args)
        m = re.search(r'\bID (\w+)', self)
        self.id = m.group(1)
        return self

    def __hash__(self):
        return hash(self.id)

    def __eq__(self, other):
        return self.id == other.id

    def __ne__(self, other):
        return self.id != other.id

然后您可以将您的普通字符串转换为 IdString 对象并将它们传递给 difflib，如下所示:

from difflib import unified_diff

text1 = '''T0 ID A
T1 ID B
T2 ID C
T4 ID D
'''

text2 = '''T5 ID A
T6 ID E
T7 ID F
T8 ID D
'''

print(''.join(unified_diff(map(IdString, text1.splitlines(True)),
                           map(IdString, text2.splitlines(True)),
                           n=0)))

它产生的输出非常接近你想要的:

--- 
+++ 
@@ -2,2 +2,2 @@
-T1 ID B
-T2 ID C
+T6 ID E
+T7 ID F

(您问题中的示例说 @-1,2 +1,2 但我无法完全重现，因为我不知道 diff 的风格和行号diff 输出从 1 开始。)

关于python - 对 2 个文本执行差异，仅使用文本中每一行的一部分，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/18795607/

26

4

0

文章推荐： php - 对 2 深数组进行多排序

文章推荐： java - Hibernate @ManyToOne 引用类使用@NaturalId 而不是@Id

文章推荐： java - Myclass.class.getProtectionDomain().getCodeSource() 返回空路径

文章推荐： algorithm - 纸牌魔术序列递归算法

Python 一行
我想要以下代码的 Python 单行解决方案，但是怎么做呢？ total = 0 for ob in self.oblist: total += sum(v.amount for v in o
一行 Python 代码轻松构建树状热力图
今天和大家一起学习一种可视化技术：构建树状热力图treemap。树形图易于可视化，且易于被人理解。树状图通过展示不同大小的矩形，以传达不同大小的数据量，一般认为，较大的矩形意味着占总体的一大部分，而较
if-statement - 一行 if 语句
就目前而言，这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持，但这个问题可能会引起辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开，visit the he
Perl 一行 if 语句
我有一个声明 $set eq "Y" ? $set = "N" : $set = "Y"; 但不管它总是设置为 "N" # Toggle setting if ($set eq "Y") { $
PHP代码显示不正确[一行] EOL
当我尝试在我的服务器上上传一个 php 文件时，我收到一条消息:"Parse error: ..." 我知道这是什么意思，但问题是别的。如果我在本地服务器上编辑文件(我的计算机上安装了 XAMPP)
python - 一行 for 循环用于具有变量增量和二维列表搜索的二维列表
我是 python oneliner 循环的新手。我希望用户将数据输入到二维列表中，同时提醒他他们将输入的数据索引。我的代码是: flag=0 x=[[int(input("enter the "+
变量后面可以输出字符串吗？ (一行 printf)
尝试在变量之前和之后打印字符串。C 是否有能力使用一条语句来显示此输出？这有效: float value = 5; printf("\nThe value of %f", value); print
mysql - 一行/水平显示MySQL查询的输出
我正在验证我创建的 MySQL 数据库的结果，为此，我需要一些屏幕截图。例如，以下查询: select distinct run_ID from ngsRunStats_FK.failedRuns
一行 JavaScript 测试和赋值
有人可以解释一下这个 JS LINE 吗？数据是一个对象。 var list = data == null ? [] : (data.wine instanceof Array ? data.wine
一行 HTML 下拉列表
如何在一行中添加三个下拉菜单。我想把我的日、月和年放在一行中，但不能这样做。任何帮助将不胜感激。我附上我的 jsfiddle . .... 最佳
html 100%-(一行)
我正在尝试使用 html 将 iframe 的高度设置为 100%(我已成功完成)，但我还在顶部添加了一行额外的文本，所以它太高了 ~16px(这需要一个滚动条)。有没有办法更改 iframe 以显示
java - 将字符串数组写入文件 - 一行？
这是一个示例，我从文件中读取行作为字符串，以使整个文件作为字符串数组: String[] ArrayOfStrings = (new Scanner( new File("log.txt") ).us
c - 一行#if语句
我有一个包含大量定义的配置文件，用于在编译期间包含模块。此外，这意味着我必须经常检查代码内部的定义。每张支票需要 3 行，是否可以在一行中执行此操作。 #if FUNC_ENABLED functio
css - 水平列表不内联/一行
我正在尝试制作一个水平列表，其中每个列表中的 s 的高度为 385px，宽度为 400px。我尝试使用 inline-block 使列表水平排列，但这似乎不起作用。也就是说，我的意思是列表仍然是垂
一行 CSS，无法比较免费和付费主题文件
这很烦人，我有一个带有 css 文件的 wordpress 主题，所有内容都在一长行中。我想知道为什么有人会那样做。现在我已经升级了，我需要将旧文件与新文件进行比较，以便我可以接受更改。 Meld、d
python - 一行 for 循环并修改对象
我有一个对象数组，其中每个对象都有一个 search_order 属性。我要检查数组并将所有对象的属性增加 1这是简单的方法: res = [] for r in array: r.searc
linux - 移动文件并重命名 - 一行
我在某些服务器上遇到许多具有相同内容和相同名称的文件。我需要隔离这些文件进行分析，所以我不能只删除重复项。操作系统为Linux(centos和ubuntu)。我枚举文件名和位置并将它们放入文本文件中
Javascript 拼图 - 一行
你能在不抛出错误的情况下解决这个问题吗？答案是单线。这是来自一个死的职位发布，在回复中要求回答。我认为这是剔除受访者的聪明方法，但我似乎无法在不出错的情况下回答它。显而易见的解决方案: f.moo(
Java 一行 if 语句
这个问题在这里已经有了答案: Is it ok if I omit curly braces in Java? [closed] (16 个答案) 关闭 9 年前。我在 java 中使用没有大括号
python - 一行，三个变量
我在这里试图用 python 制作一个简单的计算器，我想知道是否可以在命令运行时将前 3 行合并为一行。我的意思是；我不必按 Enter 键来键入下一个数字/运算符，而是按空格键(在输入部分)。 wh

首页

博学

6Ren·AI

商城

python - 对 2 个文本执行差异，仅使用文本中每一行的一部分