azure - 了解 Azure 事件中心分区使用者模式-6ren

azure - 了解 Azure 事件中心分区使用者模式

转载作者：行者123 更新时间：2023-12-04 01:00:03

25

4

Azure 事件中心使用 docs 中描述的分区使用者模式。。当涉及到现实世界场景时，我在理解该模型的消费者方面存在一些问题。

假设我有 1000 条消息发送到带有 4 个分区的事件中心，但没有定义任何分区 ID。这意味着消息将使用循环方法发送到所有分区。

现在我想让两个应用程序将消息分发到两个不同的数据库。我的问题是:

假设对于第一个应用程序，我想将所有消息存储在数据库 1 中。这意味着，为了获得最大速度，在我的消费者应用程序中，我需要有 4 个线程(消费者)，每个线程监听事件中心的一个分区，正确的？他们每个人还必须存储自己正在读取的分区的偏移量(检查点)。
假设我的第二个应用程序想要过滤消息并仅将其中的一部分存储在数据库 2 中。我还需要 4 个使用者，因为我不知道哪条消息发送到哪个分区，对吧？
另外，对于这两个应用程序，我需要有两个消费者组，但为什么呢？消息的过滤是在消费者组中定义的吗？我不明白为什么我需要这个，因为应用程序使用者自己存储分区检查点，并且我可以在应用程序本身内进行过滤。

我知道有EventProcessorHost类，但我想在较低级别上了解 EventHub 的概念。

最佳答案

Lets say for the first application, I want to store all messages in Database 1. This means, for maximum speed, In my consumer application I need to have 4 threads (consumers), each listening to one partition of the event hub, right? Each of them also has to store their own offset for the partition they're reading (checkpoint).

正确，每个配置的分区都应该有一个进程。因此，如果您有 4 个处理器，则应该有 4 个进程，每个进程处理特定分区的消息。如果您使用 EventProcessorHost 处理消息，它将为您负责进程的旋转。

Lets say my second application wants to filter the messages and only store a subset of them in Database 2. There I also need 4 consumers since I don't know which message goes to which partition, right?

消费者是什么意思？您需要另外 4 个进程来处理消息但是它们应该配置为使用不同的使用者组进行读取。否则它们将与 1 的进程竞争

Also for the two applications I need to have two consumer groups, but why? Is the filtering of the messages defined in the consumer group? I don't get it really why I need this one, since the applications consumers store the partition checkpoints by themselves and I can do the filtering within the applications itself.

让我们定义一个消费者组:

消费者组使多个消费应用程序能够各自拥有传入消息流的单独 View ，并以自己的速度和自己的偏移量独立读取流

所以，是的，您需要 2 个不同的消费者群体。每个消费者组将获取发送到事件中心分区的所有消息。每个消费者组在消息流中跟踪自己的进度。这就是为什么您的场景需要两个。

假设您定义了一个名为“App2-Consumer-Group”的附加消费者组，读取器进程将接收所有消息，但不应对他们不感兴趣的消息采取任何操作。

如果您不创建额外的使用者组，则默认使用者组的读取器进程将处理第一个应用程序的消息，并使用检查点机制将它们标记为已处理。第二个应用程序的读取器进程不会收到任何消息，因为它们已被标记为已处理。 (在现实生活中，当使用一个消费者组时，某些消息可能会被第一个应用程序的读取器进程拾取，而某些消息可能会被第二个应用程序的读取器进程拾取，因为这些进程将尝试获取某个消息的锁定。特定分区)

我认为这张图清楚地显示了消费者组如何跟踪自己在消息流中的进度，因此如果您对 2 个不同的应用程序有 2 个不同的处理逻辑，那么为什么您需要两个它们:

关于azure - 了解 Azure 事件中心分区使用者模式，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/59086482/

25

4

0

文章推荐： pytorch - PyTorch 中的自定义损失函数

文章推荐： r - 矩阵数学与 Sparklyr

文章推荐： c# - 克隆 Office Open XML 文档的最有效方法是什么？

Neo4j 分区
是一种在 Neo4j 分区之间进行物理分离的方法吗？这意味着以下查询将转到 node1: Match (a:User:Facebook) 虽然此查询将转到另一个节点(可能托管在 docker 上)
非企业服务器上的 SQL 分区？
我尝试在我的 SQL 服务器上使用分区函数对我的一个大表进行分区，但我收到一条错误消息 “只能在SQL Server企业版中创建分区功能。只有SQL Server企业版支持分区。” 所以我想知道没有企
hadoop - hadoop中的文件拆分/分区
在hadoop文件系统中，我有两个文件，分别是X和Y。通常，hadoop制作的文件X和Y的大小为64 MB。是否可以强制hadoop划分两个文件，以便从X的32 MB和Y的32 MB中创建一个64 M
组合键的 Cassandra 分区
据我了解，如果我们有一个主键，则使用该键对数据进行分区并将其存储在节点中(例如使用随机分区器)。现在我不确定的是，如果我有多个键(又名复合键)，是用于分区数据的键的组合还是它将是第一个主键？例如，
SSAS 分区，多少太多了
我正在向我的 SSAS 多维数据集添加分区，我想知道是否有多个分区可以保留在下面？多少太多了，最佳实践限制是 20 还是 200？有没有人可以分享任何真实世界的知识？最佳答案这是 another
MySQL 分区 - 主键和唯一记录的错误
我有一个包含大约 200 万条记录的大表，我想对其进行分区。我将 id 列设置为 PRIMARY AUTO_INCRMENT int (并且它必须始终是唯一的)。我有一列“theyear”int(4
Mysql 分区 - 如何对包含唯一列的表进行列表分区？
我正在做 mysql 列表分区。我的表数据如下 ---------------------------------------- id | unique_token | city | student_
具有大量插入和删除的表的 MySQL 分区
我有一个表，我们每天在其中插入大约 2000 万个条目(没有任何限制的盲插入)。我们有两个外键，其中一个是对包含大约 1000 万个条目的表的引用 ID。我打算删除此表中超过一个月的所有数据，因为不
真实示例中的 MySQL 分区
我想在一款足球奇幻游戏中尝试使用 MySQL Partitioning，该游戏的用户分布在联赛中，每个联赛都有一个用户可以买卖球员的市场。当很多用户同时玩时，我在这张表中遇到了一些僵局(在撰写本文时大
带有变量的 jQuery 分区
我是 jQuery 的新手，想知道是否可以获取一些变量并将它们的除法作为 CSS 宽度。到目前为止我在这里: var x = $(".some-container").length; var y =
c++ - 分区、斯特林数和第一个切比雪夫多项式的递归函数
所以我正在做家庭作业，我需要为分区、斯特林数(第一类和第二类)和第一类的切比雪夫多项式创建递归函数。我的程序应该能够让用户输入一个正整数 n，然后创建名为 Partitions.txt、Stirlin
python - 分区(如果适用)
我在数据框中有一列，其中包含大约 1,4M 行聊天对话，其中每个单元格中的一般格式为 (1): “名称代理 : 对话” 但是，并非列中的所有单元格都采用这种格式。有些单元格只是 (2): “对话” 我
html - "Collapsible"<分区>
我在尝试隐藏 a 时遇到了一些问题，直到用户单击某个元素为止。 HTML 看起来像: BRAND item 1 item 2 item 3
【kafka】-分区-消费端负载均衡
一.为什么kafka要做分区？因为当一台机器有可能扛不住（类比：就像redis集群中的redis-cluster一样，一个master抗不住写，那么就多个master去抗写）
postgresql - 分区(和拆分)值以填充槽
我有一些销售数据，我需要发送存储在单独表中的可用槽中的数量。销售数据示例: id数量112131415369 create table sales (id serial primary key, q
GlusterFS - 为什么不推荐使用 root 分区？
我计划设置多个节点以使用 glusterfs 创建分布式复制卷我使用主(也是唯一)分区上的目录在两个节点上创建了一个 gluster 复制卷。 gluster volume create vol_d
sql - 在窗口函数内过滤(通过...分区)？
我正在尝试使用 sum() over (partition by) 但在总和中过滤。我的用例是将每个产品的 12 个月累计到一个月的条目，因此: ITEM MONTH SALES Item
scala - 如何从单个枚举器中生成多个枚举器(分区、拆分、..)
是否可以创建多个 Enumerators出单Enumerator ? 我正在寻找的相当于 List.partition返回 (List[A], List[A]) ，比如 List().partitio
Yocto - 创建并填充一个单独的/home 分区
我正在创建一个基于 x86 的非常简单的 Yocto 图像。我希望/文件系统是只读的，所以我设置了 IMAGE_FEATURES_append = " read-only-rootfs " 在原件的
list - Scala 分区/收集用法
是否可以使用一次 collect 调用来创建 2 个新列表？如果没有，我该如何使用分区来做到这一点？最佳答案 collect(在TraversableLike上定义并在所有子类中可用)与集合和Par

首页

博学

6Ren·AI

商城

azure - 了解 Azure 事件中心分区使用者模式