apache-storm - 三叉戟拓扑中的并行配置( Storm )-6ren

apache-storm - 三叉戟拓扑中的并行配置( Storm )

转载作者：行者123 更新时间：2023-12-02 00:04:55

25

4

看完this和 this我很难理解如何配置我的三叉戟拓扑。

基本上我的 Storm 应用程序正在读取 kafka ，进行一些数据操作，最后写入 Cassandra .

这是我目前构建拓扑的方式:

private static StormTopology buildTopology() {
// connection to kafka
ZkHosts zkHosts = new ZkHosts(broker_zk, broker_path);
TridentKafkaConfig kafkaConfig = new TridentKafkaConfig(zkHosts, topic);
kafkaConfig.scheme = new RawMultiScheme();
StateFactoryFields[] cassandraStateFactories = createStateFactories();
TransactionalTridentKafkaSpout spout = new TransactionalTridentKafkaSpout(kafkaConfig);
TridentTopology topology = new TridentTopology();
Stream kafkaSpout = topology.newStream("kafkaspout", spout).parallelismHint(1).shuffle();
Stream filterValidatStream = kafkaSpout.each(new Fields("bytes"), new SplitKafkaInput(), EventData.getEventDataFields()).parallelismHint(1);
for (StateFactoryFields stateFactoryFields : cassandraStateFactories) {
    filterValidatStream.groupBy(stateFactoryFields.groupingFields)
        .persistentAggregate(stateFactoryFields.cassandraStateFactor, new Count(), new Fields("count")).parallelismHint(2);
}
logger.info("Building topology");
return topology.build();
}

所以我得到了一个 spout 和一些使用 parallelismHint 的操作(过滤器、groupBy)。我不知道如何确定最佳的并行性提示，此外，如果我在我的代码中设置这个值，它如何与 Storm 标准拓扑配置一起工作，例如

topology.max.task.parallelism
topology.workers
topology.acker.executors

提前致谢

最佳答案

有一个优秀的gist by mrflip here试图概述如何调整 Storm /三叉戟拓扑。这应该会指导您选择参数(包括您在问题中建议的参数和您可能尚未想到的其他参数)。

关于apache-storm - 三叉戟拓扑中的并行配置( Storm )，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/18945196/

25

4

0

文章推荐： hyperlink - 将超链接添加到 d3.js 表格行和单元格

文章推荐： rss - 更改 RSS 项目 GUID 或 Atom 条目 ID 的后果是什么？

文章推荐： c - 在不崩溃的情况下查找段错误

java - Storm 三叉戟 : How to use IPartitionedTridentSpout?
在我们的系统中，我们有多个数据生成器在共享文件系统中创建文件内容，并在文件名中指示 DataSourceId。需要有一个公平的调度机制来读取所有源生成的文件，解析、扁平化和丰富(使用引用数据)文件中的
apache-spark - Spark 或 Storm (三叉戟)
我正在尝试扩展我们系统中的一个组件，并思考在 Storm(Trident) 和 Spark 之间应该采用哪种更好的方式。因此，我们有 2 个大集合，可以包含存储在 redis 集群中的多达百万个事件

首页

博学

6Ren·AI

商城

apache-storm - 三叉戟拓扑中的并行配置( Storm )