- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
本文讨论了利用suffix tree的近似子串匹配技术。以改善匹配时间。每个答案都针对不同的算法。
T
中查找子字符串(模式)P
,最多允许k
个不匹配。我邀请人们添加新算法(即使它不完整)并改进答案。
最佳答案
这是启动此线程的原始问题。
Esko Ukkonen 教授发表了 paper :后缀树上的近似字符串匹配。他讨论了 3 种具有不同匹配时间的不同算法:
O(mq + n)
O(mq log(q) + 输出大小)
O(m^2q + 输出大小)
其中m
是子字符串的长度,n
是搜索字符串的长度,q
是编辑距离。
我一直在尝试理解算法 B,但在执行这些步骤时遇到了困难。有人有这个算法的经验吗?一个例子或伪算法将不胜感激。
特别是:
输出大小
指的是什么? 最终输出阶段列出了 T
中所有出现 Key(r)
的情况,以及标记为输出的所有状态 r
。>i
代表什么。它没有初始化并且似乎没有增加。这是我所相信的(我愿意纠正):
root
表示初始状态。g(a, c) = b
其中 a
和 b
是树中的节点,c
是树中的字符或子字符串。所以这代表了一个转变;从a
开始,沿着c
表示的边,我们移动到节点b
。这称为转到转换。因此,对于下面的后缀树,g(root, 'ccb') = red node
Key(a) = 边序列
,其中 a
表示树中的节点。例如,Key(红色节点)= 'ccb'
。所以g(root, Key(红色节点)) = 红色节点
。Keys(节点 S 的子集) = { Key(节点) |节点 ∈ S}
a
和 b
有后缀函数,f( a) = b
:对于所有(或者可能存在)a
≠ root
,存在字符c
、子字符串x
和节点b
使得 g(root, cx) = a
且 g(root, x) = b
。我认为,对于上面的后缀树示例,f(粉红色节点)= 绿色节点
,其中 c = 'a'
和 x = 'bccb'
。H
,其中包含后缀树中的一个节点和一个值对。该值由 loc(w)
给出;我仍然不确定如何评估该功能。该字典包含尚未消除的节点。extract-min(H)
指的是获取对中具有最小值的条目(node, loc(w))
来自 H
。该算法的关键似乎与 loc(w)
的评估方式有关。我使用组合答案 here 构建了后缀树;然而,这些算法适用于后缀特里树(未压缩的后缀树)。因此,像深度这样的概念需要以不同的方式维护和处理。在后缀特里树中,深度代表后缀长度;在后缀树中,深度仅表示树中的节点深度。
关于algorithm - 使用后缀树近似子字符串匹配,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/19368962/
关于 B 树与 B+ 树,网上有一个比较经典的问题:为什么 MongoDb 使用 B 树,而 MySQL 索引使用 B+ 树? 但实际上 MongoDb 真的用的是 B 树吗?
如何将 R* Tree 实现为持久(基于磁盘)树?保存 R* 树索引或保存叶值的文件的体系结构是什么? 注意:此外,如何在这种持久性 R* 树中执行插入、更新和删除操作? 注意事项二:我已经实现了一个
目前,我正在努力用 Java 表示我用 SML 编写的 AST 树,这样我就可以随时用 Java 遍历它。 我想知道是否应该在 Java 中创建一个 Node 类,其中包含我想要表示的数据,以及一个数
我之前用过这个库http://www.cs.umd.edu/~mount/ANN/ .但是,它们不提供范围查询实现。我猜是否有一个 C++ 范围查询实现(圆形或矩形),用于查询二维数据。 谢谢。 最佳
在进一步分析为什么MySQL数据库索引选择使用B+树之前,我相信很多小伙伴对数据结构中的树还是有些许模糊的,因此我们由浅入深一步步探讨树的演进过程,在一步步引出B树以及为什么MySQL数据库索引选择
操作系统的那棵“树” 今天从一颗 开始,我们看看如何从小树苗长成一颗苍天大树。 运转CPU CPU运转起来很简单,就是不断的从内存取值执行。 CPU没有好好运转 IO是个耗费时间的活,如果CPU在取值
我想为海洋生物学类(class)制作一个简单的系统发育树作为教育示例。我有一个具有分类等级的物种列表: Group <- c("Benthos","Benthos","Benthos","Be
我从这段代码中删除节点时遇到问题,如果我插入数字 12 并尝试删除它,它不会删除它,我尝试调试,似乎当它尝试删除时,它出错了树的。但是,如果我尝试删除它已经插入主节点的节点,它将删除它,或者我插入数字
B+ 树的叶节点链接在一起。将 B+ 树的指针结构视为有向图,它不是循环的。但是忽略指针的方向并将其视为链接在一起的无向叶节点会在图中创建循环。 在 Haskell 中,如何将叶子构造为父内部节点的子
我在 GWT 中使用树控件。我有一个自定义小部件,我将其添加为 TreeItem: Tree testTree = new Tree(); testTree.addItem(myWidget); 我想
它有点像混合树/链表结构。这是我定义结构的方式 struct node { nodeP sibling; nodeP child; nodeP parent; char
我编写了使用队列遍历树的代码,但是下面的出队函数生成错误,head = p->next 是否有问题?我不明白为什么这部分是错误的。 void Levelorder(void) { node *tmp,
例如,我想解析以下数组: var array1 = ["a.b.c.d", "a.e.f.g", "a.h", "a.i.j", "a.b.k"] 进入: var json1 = { "nod
问题 -> 给定一棵二叉树和一个和,确定该树是否具有从根到叶的路径,使得沿路径的所有值相加等于给定的和。 我的解决方案 -> public class Solution { public bo
我有一个创建 java 树的任务,它包含三列:运动名称、运动类别中的运动计数和上次更新。类似的东西显示在下面的图像上: 如您所见,有 4 种运动:水上运动、球类运动、跳伞运动和舞蹈运动。当我展开 sk
我想在 H2 数据库中实现 B+ Tree,但我想知道,B+ Tree 功能在 H2 数据库中可用吗? 最佳答案 H2 已经使用了 B+ 树(PageBtree 类)。 关于mysql - H2数据库
假设我们有 5 个字符串数组: String[] array1 = {"hello", "i", "cat"}; String[] array2 = {"hello", "i", "am"}; Str
我正在处理树。每个节点都有带有 Tree * 值的对象。我读取的数据如下所示: 1 2 2 ... 这意味着,将 1 作为 0 的子节点,将 2 作为 1 的子节点,将 3 作为 o 2 的子节点。在
我正在寻找一个好的 JavaScript 树/树网格包。现在——在你回答之前: 它需要能够在大量节点上正常运行。可能有 1,000 个兄弟节点。它需要能够在 2 或 3 秒内绘制到 1,000 个节点
下面的代码块究竟是如何工作的?更具体地说,程序如何知道返回哪个选项? return ancestor (node1->left(), node2) || ancestor
我是一名优秀的程序员,十分优秀!