- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
(还有几个关于超时和 maxSpoutPending 的问题)
我在 Storm 文档中看到很多关于消息被完全处理的引用。但是我的 KafkaSpout 如何知道消息何时被完全处理?
希望它知道我的 bolt 连接方式,所以当我的 Stream 中的最后一个 bolt 确认一个元组时,spout 知道我的消息何时被处理?
否则,我会想象在超时期限到期后,将检查消息的确认状态,如果确认/ anchor 定 XOR 指示,则将其视为已处理。但我希望不是这样?
我也有关于 maxTuplesPending 和超时配置的相关问题。
如果我将 maxTuplePending 设置为 10k,那么我是否认为每个 spout 实例将继续发出元组,直到该 spout 实例正在跟踪 10k 元组,10k 元组尚未完全处理?然后当当前正在传输的消息被完全处理时会发出一个新的元组?
最后,这与超时配置有关吗?在发送新消息之前,spout 是否以任何方式等待配置的超时发生?或者超时配置是否仅在消息被停止/处理缓慢时才起作用,导致由于超时而失败?
更简洁(或者希望更清楚),将我的超时设置为 30 分钟是否有影响,除非消息在 30 分钟内被最终 Bolt 确认,否则消息不会失败?或者是否有其他影响,例如超时配置会影响 spouts 的发射率?
抱歉问了这么长、漫无目的的问题。提前感谢您的任何回复。
*编辑以进一步澄清
这对我来说是一个问题,因为我的消息不一定贯穿整个 Stream。
假设我有 bolt A、B、C、D。大多数情况下,消息将从 A->B->->D 传递。但是我有一些消息会故意停止在 bolt A 上。 A 会确认它们但不会发出它们(因为我的业务逻辑,在这些情况下,我确实希望对消息进行进一步处理)。
那么我的 KafkaSpout 会知道已确认但未从 A 发出的消息已完全处理吗?因为我希望在 Bolt A 完成后立即从 spout 发出另一条消息,在这种情况下。
最佳答案
Storm 通过 UDF 代码必须使用的 anchor 定机制跟踪整个拓扑中的元组。这种 anchor 定导致了所谓的元组树,树的根是 spout 发出的元组,所有其他节点(在树结构中连接)表示从使用输入元组作为 anchor 的 bolts 发出的元组(这只是一个逻辑模型,并没有在 Storm 中以这种方式实现,尽管如此)。
例如,Spout 发出一个句子元组,该元组被单词中的第一个 bolt 分割,一些单词由第二个 bolt 过滤,并且单词计数由第三个 bolt 应用。最后,sink bolt 将结果写入文件。这棵树看起来像这样:
"this is an example sentence" -+-> "this"
+-> "is"
+-> "an"
+-> "example" -> "example",1 -> "example",1
+-> "sentence" -> "sentence",1 -> "sentence",1
Spout.ack(MessageId)
的回调用发生(即,当元组被完全处理时,回调用立即完成)。此外,ackers 会定期检查是否存在由 acker 注册的元组超过超时时间。如果发生这种情况,acker 会丢弃元组 ID,并向 spout 发送一条消息,表示元组失败(导致调用
Spout.fail(MessageId)
)。
Spout.nextTuple()
参数,则停止调用
maxTuplesPending
。据我所知,该参数是全局应用的,即每个 spout 任务的本地计数相加,并将全局计数与参数进行比较(但不确定具体是如何实现的)。
timeout
参数独立于
maxTuplesPending
。
关于apache-storm - Storm 如何知道消息何时是 "fully processed"?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/33546052/
在流处理方面,Apache Beam和Apache Kafka之间有什么区别? 我也试图掌握技术和程序上的差异。 请通过您的经验报告来帮助我理解。 最佳答案 Beam是一种API,它以一种统一的方式使
有点n00b的问题。 如果我使用 Apache Ignite 进行消息传递和事件处理,是否还需要使用 Kafka? 与 Ignite 相比,Kafka 基本上会给我哪些(如果有的话)额外功能? 提前致
Apache MetaModel 是一个数据访问框架,它为发现、探索和查询不同类型的数据源提供了一个通用接口(interface)。 Apache Drill 是一种无架构的 SQL 查询引擎,它通过
Tomcat是一个广泛使用的java web服务器,而Apache也是一个web服务器,它们在实际项目使用中有什么不同? 经过一些研究,我有了一个简单的想法,比如, Apache Tomcat Ja
既然简单地使用 Apache 就足以运行许多 Web 应用程序,那么人们何时以及为什么除了 Apache 之外还使用 Tomcat? 最佳答案 Apache Tomcat是一个网络服务器和 Java
我在某个 VPS( friend 的带 cPanel 的 apache 服务器)上有一个帐户,我在那里有一个 public_html 目录。我们有大约 5-6 个网站: /home/myusernam
我目前正在尝试将模块加载到 Apache,使用 cmake 构建。该模块称为 mod_mapcache。它已成功构建并正确安装在/usr/lib/apache2/modules directroy 中
我对 url 中的问号有疑问。 例如:我有 url test.com/controller/action/part_1%3Fpart_2 (其中 %3F 是 url 编码的问号),并使用此重写规则:R
在同一台机器上,Apache 在端口 80 上运行,Tomcat 在端口 8080 上运行。 Apache 包括 html;css;js;文件并调用 tomcat 服务。 基本上 exampledom
Apache 1 和 Apache 2 的分支有什么区别? 使用一种或另一种的优点和缺点? 似乎 Apache 2 的缺点之一是使用大量内存,但也许它处理请求的速度更快? 最有趣的是 Apache 作
实际上,我们正在使用 Apache 网络服务器来托管我们的 REST-API。 脚本是用 Lua 编写的,并使用 mod-lua 映射。 例如来自 httpd.conf 的实际片段: [...] Lu
我在 apache 上的 ubuntu 中有一个虚拟主机,这不是我的主要配置,我有另一个网页作为我的主要网页,所以我想使用虚拟主机在同一个 IP 上设置这个。 urologyexpert.mx 是我的
我使用 Apache camel 已经很长时间了,发现它是满足各种系统集成相关业务需求的绝佳解决方案。但是几年前我遇到了 Apache Nifi 解决方案。经过一番谷歌搜索后,我发现虽然 Nifi 可
由于两者都是一次处理事件的流框架,这两种技术/流框架之间的核心架构差异是什么? 此外,在哪些特定用例中,一个比另一个更合适? 最佳答案 正如您所提到的,两者都是实时内存计算的流式平台。但是当您仔细观察
apache 文件(如 httpd.conf 和虚拟主机)中使用的语言名称是什么,例如 # Ensure that Apache listens on port 80 Listen 80 D
作为我学习过程的一部分,我认为如果我扩展更多关于 apache 的知识会很好。我有几个问题,虽然我知道有些内容可能需要相当冗长的解释,但我希望您能提供一个概述,以便我知道去哪里寻找。 (最好引用 mo
关闭。这个问题是opinion-based .它目前不接受答案。 想改善这个问题吗?更新问题,以便可以通过 editing this post 用事实和引文回答问题. 4 个月前关闭。 Improve
就目前而言,这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持,但这个问题可能会引起辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开,visit the he
这个问题在这里已经有了答案: Difference Between Apache Kafka and Camel (Broker vs Integration) (4 个回答) 3年前关闭。 据我所知
我有 2 个使用相同规则的子域,如下所示: RewriteEngine On RewriteCond %{REQUEST_FILENAME} !-f RewriteCond
我是一名优秀的程序员,十分优秀!