- Java 双重比较
- java - 比较器与 Apache BeanComparator
- Objective-C 完成 block 导致额外的方法调用?
- database - RESTful URI 是否应该公开数据库主键?
我正在使用 Flink 进行一些概念验证工作,并且已经到了我想在 4 节点集群上尝试各种工作(拓扑?)的地步。
机器:
拓扑从 3 到 6 个“任务”( worker ? bolt 模拟?)不等。我希望这里有人可以提供一些建议的设置。具体来说:
特别是一项任务:从 Kafka 读取,其中有问题的主题有 6 个分区。我想从这些分区中的每一个中读取、聚合并写入 Cassandra。当我在 Storm 中实现这项工作时,它有 6 个 bolts 用于读取数据和数倍的数据写入。 (IE 6 读,18 写)
如果 Flink 被我的公司采用,每台机器将同时运行许多作业。在这种情况下配置参数将如何改变?
FWIW:集群是 v1.0-SNAPSHOT。
编辑:This看起来很有用。
1 “网络缓冲区数量不足:需要 30 个,但只有 8 个可用。网络缓冲区总数当前设置为 2048。”这是否意味着 2000 个缓冲区在没有发生任何事情时被使用?
最佳答案
有多个来源可以帮助您设置正确的设置(见下文)
立即解决您的问题:
taskmanager.heap.mb:“这个值应该尽可能大。” 96GB?真的吗?
基本上是的,但要视情况而定 如果您在集群中手动部署 Flink,则假定 Flink 是唯一运行的系统。如果不将此参数设置得尽可能大,那将是一种浪费。对于与其他系统的共享设置,您可能需要考虑使用 YARN。另一方面,在独立集群模式下运行时,您可能希望为操作系统保留一些内存,如果您知道还有其他组件在运行,您可能不会将所有内存分配给 Flink。但是,由于 Flink 在内部管理内存,因此您应该避免使用未使用的内存。
parallelism.default:尝试将其设置为 30。遇到此错误。
查看以下配置参数: taskmanager.network.numberOfBuffers
和 taskmanager.network.bufferSizeInBytes
(也可以在这里查看 http://www.slideshare.net/FlinkForward/fabian-hueske-juggling-with-bits-and-bytes?ref=http://flink-forward.org/?post_type=session,此处http://de.slideshare.net/robertmetzger1/apache-flink-hands-on 和这里的 https://www.youtube.com/playlist?list=PLDX4T_cnKjD3F7oRSov8hT21rXx1SyXf8 )
parallelization.degree.default:我尝试提高这个值,但似乎没有任何效果。任务始终显示“1”表示并行度。
如果我没记错的话,这个参数被替换成了 parallelism.default
查看此链接了解更多背景信息:
一般常见问题解答、Flink 博客和 Flink Forward 谈话:
关于java - flink 集群参数 - 如何设置,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/33589710/
简而言之:我想从可变参数模板参数中提取各种选项,但不仅通过标签而且通过那些参数的索引,这些参数是未知的 标签。我喜欢 boost 中的方法(例如 heap 或 lockfree 策略),但想让它与 S
我可以对单元格中的 excel IF 语句提供一些帮助吗? 它在做什么? 对“BaselineAmount”进行了哪些评估? =IF(BaselineAmount, (Variance/Baselin
我正在使用以下方法: public async Task Save(Foo foo,out int param) { ....... MySqlParameter prmparamID
我正在使用 CodeGear RAD Studio IDE。 为了使用命令行参数测试我的应用程序,我多次使用了“运行 -> 参数”菜单中的“参数”字段。 但是每次我给它提供一个新值时,它都无法从“下拉
我已经为信用卡类编写了一些代码,粘贴在下面。我有一个接受上述变量的构造函数,并且正在研究一些方法将这些变量格式化为字符串,以便最终输出将类似于 号码:1234 5678 9012 3456 截止日期:
MySql IN 参数 - 在存储过程中使用时,VarChar IN 参数 val 是否需要单引号? 我已经像平常一样创建了经典 ASP 代码,但我没有更新该列。 我需要引用 VarChar 参数吗?
给出了下面的开始,但似乎不知道如何完成它。本质上,如果我调用 myTest([one, Two, Three], 2); 它应该返回元素 third。必须使用for循环来找到我的解决方案。 funct
将 1113355579999 作为参数传递时,该值在函数内部变为 959050335。 调用(main.c): printf("%d\n", FindCommonDigit(111335557999
这个问题在这里已经有了答案: Is Java "pass-by-reference" or "pass-by-value"? (92 个回答) 关闭9年前。 public class StackOve
我真的很困惑,当像 1 == scanf("%lg", &entry) 交换为 scanf("%lg", &entry) == 1 没有区别。我的实验书上说的是前者,而我觉得后者是可以理解的。 1 =
我正在尝试使用调用 SetupDiGetDeviceRegistryProperty 的函数使用德尔福 7。该调用来自示例函数 SetupEnumAvailableComPorts .它看起来像这样:
我需要在现有项目上实现一些事件的显示。我无法更改数据库结构。 在我的 Controller 中,我(从 ajax 请求)传递了一个时间戳,并且我需要显示之前的 8 个事件。因此,如果时间戳是(转换后)
rails 新手。按照多态关联的教程,我遇到了这个以在create 和destroy 中设置@client。 @client = Client.find(params[:client_id] || p
通过将 VM 参数设置为 -Xmx1024m,我能够通过 Eclipse 运行 Java 程序-Xms256M。现在我想通过 Windows 中的 .bat 文件运行相同的 Java 程序 (jar)
我有一个 Delphi DLL,它在被 Delphi 应用程序调用时工作并导出声明为的方法: Procedure ProduceOutput(request,inputs:widestring; va
浏览完文档和示例后,我还没有弄清楚 schema.yaml 文件中的参数到底用在哪里。 在此处使用 AWS 代码示例:https://github.com/aws-samples/aws-proton
程序参数: procedure get_user_profile ( i_attuid in ras_user.attuid%type, i_data_group in data_g
我有一个字符串作为参数传递给我的存储过程。 dim AgentString as String = " 'test1', 'test2', 'test3' " 我想在 IN 中使用该参数声明。 AND
这个问题已经有答案了: When should I use "this" in a class? (17 个回答) 已关闭 6 年前。 我运行了一些java代码,我看到了一些我不太明白的东西。为什么下
我输入 scroll(0,10,200,10);但是当它运行时,它会传递字符串“xxpos”或“yypos”,我确实在没有撇号的情况下尝试过,但它就是行不通。 scroll = function(xp
我是一名优秀的程序员,十分优秀!