algorithm - Levenshtein 距离算法中的冗余-6ren

algorithm - Levenshtein 距离算法中的冗余

转载作者：塔克拉玛干更新时间：2023-11-03 06:26:30

26

4

在典型的动态编辑距离算法中，计算单元格d[i][j]的值，其中i和j分别是行号和列号，我们取d[i-1][j-1]+0/1中的最小值，d[i-1][j]+ 1 和 d[i][j-1]+1。但是，在我看来，d[i-1][j-1]+0/1 和 d[i-1][j]+1 中的最小值> 总是 d[i-1][j-1]+0/1，在这种情况下包括 d[i-1][j]+1 在计算中似乎是多余的。 Levenshtein 中的 d[i-1][j-1]+0/1 > d[i-1][j]+1 是否曾经是这种情况距离算法，如果不是，省略这个比较不是更有效吗？

编辑:对于研究不足的问题深表歉意；该算法的任何标准运行都会显示 d[i-1][j-1]+0/1 > d[i-1][j]+1 的实例:

    A
 +-+-+
 |0|1|
 +-+-+
A|1|0|
 +-+-+

(考虑第二行)。

最佳答案

引用Wikipedia Article ，最后一种情况下的最小值必须在“删除”情况下取。

假设我们要计算 abc 和 ab 之间的 Levenshtein 距离(从现在开始固定并从符号中省略)。

迭代评估产生以下中间结果。

lev(0,0) = 0 (1st case applies)
lev(0,1) = 1 (1st case applies)
lev(0,2) = 2 (1st case applies)

lev(1,0) = 1 (1st case applies)
lev(1,1) = min(2,2,0) (2nd case, minimum taken in last term) = 0
lev(1,2) = min(1,2,1) (2nd case, minumum taken in last term) = 1

lev(2,0) = 2 (1st case applies)
lev(2,1) = min(3,1,2) (2nd case, minimum taken in second term) = 1 (*)
lev(2,2) = min(2,2,0) (2nd case, minimum taken in the last term) = 0

lev(3,0) = 3 (1st case applies)
lev(3,1) = min(4,2,2) (2nd case, minimum taken in the second and third term) = 2
lev(3,2) = min(3,1,2) (2nd case, minimum taken in the second term) = 1 (*)

标有 (*) 的行是出现第二种情况的情况，但最小值未在上学期被采用。可以找到还显示动态规划表的在线计算器 here .

关于algorithm - Levenshtein 距离算法中的冗余，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/24743832/

26

4

0

文章推荐： python - 求解异或方程组的最优算法

文章推荐： algorithm - 霍纳法则计算求和的效率

文章推荐： mysql - SQL Select Query中的Where条件算法

文章推荐： javascript - 在固定 block 中按比例调整图像大小

levenshtein-distance - Damerau-Levenshtein php
我正在寻找 Damerau–Levenshtein 的实现PHP 的算法，但我的 friend google 似乎找不到任何东西。到目前为止，我必须使用 PHP 实现的 Levenshtein(没有
java - Levenshtein 到 Damerau-Levenshtein
我坐在这里用 Java 为我的主程序编写一些算法(这是迄今为止的第一个)。我对 levenshtein 算法进行了很好的编程，这要归功于 wiki 对新手的伪代码非常好，还有一个很好的教程 :D 然后
algorithm - Levenshtein Automata 和 Damerau-Levenshtein 距离算法有什么区别？
关闭。这个问题不符合Stack Overflow guidelines .它目前不接受答案。问题必须表现出对正在解决的问题的最低限度的理解。告诉我们您尝试过的方法、为什么不起作用以及它应该起作用
PHP改进计算字符串相似度的函数similar_text()、levenshtein()
similar_text()中文汉字版复制代码代码如下: <?php &nbs
levenshtein-distance - 编辑器自动机
我实现了一个 levenshtein trie 来查找与给定单词相似的单词。我的目标是有一种快速的方法来进行拼写纠正。但是我发现有一种更快的方法可以做到这一点: 莱文斯坦自动机我只是有一个问题.
levenshtein-distance - Levenshtein和Trigram的替代品
说我的数据库中有以下两个字符串： (1) 'Levi Watkins Learning Center - Alabama State University' (2) 'ETH Library' 我的软
python - Levenshtein 距离给出奇怪的值
这是一个字符串 T : 'men shirt team brienne funny sarcasm shirt features graphic tees mugs babywear much rea
levenshtein-distance - 比较相似度算法
我想使用字符串相似度函数来查找数据库中损坏的数据。我遇到了其中几个: 贾罗，贾罗-温克勒，编辑，欧几里得和 Q-gram，我想知道它们之间有什么区别以及它们在什么情况下效果最好？最佳答案
python - Levenshtein 函数查找最接近的名称
我需要一些有关以下代码的帮助。在这种情况下，我需要找到与输入的单词最接近的单词来测试我将 word_0 设置为“pikaru”，它应该返回“pikachu”。 levenshtein 函数返回我们输入
mysql - Levenshtein 无法查找俄语单词
我有一个脚本可以使用 Levenshtein 在数据库中搜索单词。当我搜索英文单词时一切正常，但是当我搜索俄语单词时，MySQL 控制台报错: [22007][1366] (conn=31079) I
c - levenshtein 总是无限循环递归C
列支敦士登在c编程中总是返回无限循环这是我的代码我尝试了很多解决方案并且我尝试存储变量并使用指针但总是有无限循环我认为这是因为3个递归调用但在列支敦士登算法的文档中我找到了这个实现 #include
javascript - Levenshtein 阵列测距
有什么方法可以对数组使用 Levenshtein Distance例如我有一个包含多个文本的 div one,two,three,longtext,anything 和一个输入 // sometex
java - Levenshtein 距离的并行实现随着线程的增加而变慢
这是我为了好玩而编写的 Levenshtein 距离的并行实现。我对结果很失望。我在核心 i7 处理器上运行它，所以我有很多可用线程。但是，当我增加线程数时，性能会显着下降。我的意思是，对于相同大小的
PHP Levenshtein 查询结果
我想对 mysql 查询结果执行编辑。查询如下所示: $query_GID = "select `ID`,`game` from `gkn_catalog`"; $result_GID = $dbc
Postgresql levenshtein 和预组合字符与组合字符
我有包含两个相似字符的字符串。两者都显示为带有 ogonek 的小“a”: ± ± (注意:根据渲染器，它们有时呈现相似，有时略有不同) 但是，它们是不同的: 第一个字符的特征: 在 PostgreS
Elasticsearch:Levenshtein 排序
我有一个足够有效的查询，但我想通过在查询参数和相关字段之间使用 levenshtein 对结果进行排序。现在我在 ES 中进行查询，然后在我的应用程序中进行排序。现在我正在测试脚本字段。这是脚本 i
mysql - Levenshtein 距离公式在大数据库中的性能缓慢
我使用此查询来搜索公司详细信息 select * from company_details where levenshtein_ratio('New York Life Insurance Compa
python - Levenshtein 距离与字符加扰？
我正在寻找一个字符串比较指标 ala Levenshtein，当字符串中的字符被打乱时，它也可以工作。有谁知道这样的指标？如果有一个 Python 模块可以计算这样的指标，那就太好了。谢谢! 最佳答案
python - Levenshtein 实现能够处理大字符串和向量
R 中有一个名为stringdist 的package，它包含计算Levenshtein 字符串距离的函数。这个包有两个问题: 1st 它不适用于大字符串，例如: set.seed(1) a.str
python - 导入模块，Levenshtein
我正在编写一个使用比较来确定模糊匹配的脚本，因此我正在使用 Levenshtein 功能。不幸的是，当我在终端窗口中运行 easy_install python-Levenshtein 时，当我在其

首页

博学

6Ren·AI

商城

algorithm - Levenshtein 距离算法中的冗余