java - 当前队列负载如何调用Elastic Search？-6ren

java - 当前队列负载如何调用Elastic Search？

转载作者：搜寻专家更新时间：2023-11-01 02:41:44

27

4

在广泛查询 ES 时，我得到

Failed to execute [org.elasticsearch.action.search.SearchRequest@59e634e2] lastShard [true]
org.elasticsearch.common.util.concurrent.EsRejectedExecutionException: rejected execution (queue capacity 1000) on org.elasticsearch.search.
action.SearchServiceTransportAction$23@75bd024b
        at org.elasticsearch.common.util.concurrent.EsAbortPolicy.rejectedExecution(EsAbortPolicy.java:62)
        at java.util.concurrent.ThreadPoolExecutor.reject(ThreadPoolExecutor.java:823)
        at java.util.concurrent.ThreadPoolExecutor.execute(ThreadPoolExecutor.java:1369)
        at org.elasticsearch.common.util.concurrent.EsThreadPoolExecutor.execute(EsThreadPoolExecutor.java:79)
        at org.elasticsearch.search.action.SearchServiceTransportAction.execute(SearchServiceTransportAction.java:551)
        at org.elasticsearch.search.action.SearchServiceTransportAction.sendExecuteQuery(SearchServiceTransportAction.java:228)
        at org.elasticsearch.action.search.type.TransportSearchQueryThenFetchAction$AsyncAction.sendExecuteFirstPhase(TransportSearchQueryThenFetchAction.java:83)

非常定期。

我现在的计划是暂停查询请求，直到队列负载低于x。您可以查询客户端的 stats

client.admin().cluster().threadPool().stats().iterator();

但由于我的客户端不是数据节点(我想这就是原因)，我得到 queue=0 返回，而服务器节点抛出上述错误。

我知道为什么会抛出这个错误，我知道如何更新设置，但这只会推迟这个错误，并产生其他错误...

我如何询问集群节点他们的队列负载是多少？

PS:我使用的是 Java Api

我已经尝试过，没有要求的结果，空行表示另一次尝试，除非另有说明

//Nodes stats
final NodesStatsResponse nodesStatsResponse = client.admin().cluster().prepareNodesStats().execute().actionGet();
final NodeStats nodeStats = nodesStatsResponse.getNodes()[0];
final String nodeId = nodeStats.getNode().getId(); // need this later on

// same as before, but with explicit NodesStatsRequest (with id)
final NodesStatsResponse response = client.admin().cluster().nodesStats(new NodesStatsRequest(nodeId)).actionGet();
final NodeStats[] nodeStats2 = response.getNodes();
for (NodeStats nodeStats3 : nodeStats2) {
    Stats stats = nodeStats3.getThreadPool().iterator().next();
}

// Cluster?
final ClusterStatsRequest clusterStatsRequest = new ClusterStatsRequestBuilder(client.admin().cluster()).request();
final ClusterStatsResponse clusterStatsResponse = client.admin().cluster().clusterStats(clusterStatsRequest).actionGet();
final ClusterStatsNodes clusterStatsNodes = clusterStatsResponse.getNodesStats();

// Nodes info?
final NodesInfoResponse infoResponse = client.admin().cluster().nodesInfo(new NodesInfoRequest(nodeId)).actionGet();// here
final NodeInfo[] nodeInfos = infoResponse.getNodes();
for (final NodeInfo nodeInfo : nodeInfos) {
    final ThreadPoolInfo info = nodeInfo.getThreadPool();
    final Iterator<Info> infoIterator = info.iterator();
    while (infoIterator.hasNext()) {
        final Info realInfo = infoIterator.next();
        SizeValue sizeValue = realInfo.getQueueSize();
        // is no == null, then (¿happens?, was expecting a nullpointer, but Thread disappeared)
        if (sizeValue == null) 
            continue;
        // normal queue size, no load (oddly found 1000 (expected), and one of 200 in one node?)
        final long queueSize = sizeValue.getSingles(); 
    }
}

问题是某些进程需要立即调用(例如用户请求)，而其他进程可能会在数据库太忙时等待(后台进程)。我最好将一定数量的队列分配给处理即时请求的进程，将另一部分分配给后台进程(但我没有看到此选项)。

更新看起来，我没想到的是，当单独搜索的总数超过 1000 时(当 x 分片或 x 索引除以 1000/x 时，单个批量查询会出现查询过载)搜索)。所以批量化不是一个选项，除非您可以进行单个 查询。因此，当您一次定位 700 个搜索结果时(考虑到上述声明)，您需要知道队列中是否有超过 300 个项目，因为它会抛出东西。

总结:

假设每次调用的负载是最大 bulkrequest 因此我无法合并请求。那么，我如何才能在 elasticsearch 开始抛出上述异常之前开始暂停请求。所以我可以暂停应用程序的一部分，但不能暂停另一部分？如果我知道队列已满，比如说，在中途，后台进程必须 hibernate 一段时间。我如何知道(近似)队列负载？

最佳答案

您试图查看队列使用情况的方式是错误的，因为您没有查看正确的统计数据。

看看这段代码:

    final NodesStatsResponse response = client.admin().cluster().prepareNodesStats().setThreadPool(true).execute().actionGet();
    final NodeStats[] nodeStats2 = response.getNodes();

    for (NodeStats nodeStats3 : nodeStats2) {
        ThreadPoolStats stats = nodeStats3.getThreadPool();

        if (stats != null)
            for (ThreadPoolStats.Stats threadPoolStat : stats) {
                System.out.println("node `" + nodeStats3.getNode().getName() + "`" + " has pool `" + threadPoolStat.getName() + "` with current queue size " + threadPoolStat.getQueue());
            }
    }

首先，您需要setThreadPool(true) 才能取回线程池统计信息，否则它将为null。

其次，您需要 ThreadPoolStats 而不是用于线程池设置的 ThreadPoolInfo。

所以，这是您的第二次尝试，但未完成。您看到的 1000 是设置本身(最大队列大小)，而不是实际负载。

关于java - 当前队列负载如何调用Elastic Search？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/31670022/

27

4

0

文章推荐： sockets - 从 NodeJS 在 TCP 服务器上实现简单的身份验证

文章推荐： javascript - 如何在 react native 的 flatlist 中应用延迟加载

当前 = 当前 * 10 + (c - '0' );
我试图通过这段代码读取未知数量的整数: while (1) { int c = getchar (); if (c == EOF) break;
javascript - 当前、上个月和下个月的日历显示在日期选择器中
我正试图找到一个类似于谷歌分析日期选择器的日期选择器: 知道 jQuery 是否提供了类似的东西吗？最佳答案这个 Twitter Bootstrap 风格的日期范围选择器非常接近。 https:/
Javascript 当前 url
我正在使用 javascript。如何获取当前 URL 的路径并将其分配给我的代码？这是我的代码: $(document).ready(function() { $(".share").hides
bash - 如何获取(当前)儒略日数？
如何获得今天的Julian day number (JDN)相等的？或任何日期？我看了又看，但只发现了一些产生“year-dayOfYear”的函数，而不是:2457854。最佳答案在 bash
udp - 当前 udp 数据包队列长度
我有相当简单的 UDP 服务器写在 c 上。有时我需要知道在套接字中排队的所有 udp 数据包(字节)的当前长度。据我了解，getsockopt 没有得到这样的信息。欢迎使用 Linux 和 F
tinymce - 当前 TinyMCE 中的填充插件
我一直在寻找几个小时来找到一个可以在图像中添加诸如“填充:5px”之类的东西的插件。每个人都通过纯 html 做到这一点吗？我们的客户需要一种方法来简单地使用按钮或右键单击上下文菜单来添加它。有什么建
tcl - 当前 TCL 脚本的完整路径
是否有可能获得当前正在执行的 TCL 脚本的完整路径？在 PHP 中，它将是:__FILE__ 最佳答案根据“当前正在执行的 TCL 脚本”的含义，您实际上可能会寻找 info script ，甚
NHibernate 当前 session 上下文问题
我最近从直接使用 ISession 转向了包装的 ISession，即工作单元类型模式。我曾经使用 SQL Lite(内存中)对此进行测试。我有一个简单的帮助器类，它配置我的 SessionFact
webstorm - 当前 JavaScript 版本不支持解构赋值
我按照步骤操作 here在 WebStorm 中配置代码完成和其他内容，但我仍然收到以下语法错误。我该如何解决这个问题？最佳答案通过相应地将“JavaScript 语言版本”(Settings/
TFS 当前 Sprint URL
我可以为我团队的 TFS 当前 Sprint 任务板添加书签吗？我们有两周的冲刺，因此 URL 每两周更改一次。默认 URL 的形式为: http://[Server]/tfs/[Project]/
svn - 当前 Subversion 修订命令
是否有 Subversion 命令可以显示当前版本号？在svn checkout之后，我想启动一个脚本并需要变量中的修订号。如果有像 svn info get_revision_number 这样的
javascript - componentWillRecieveProps 当前 props
我正在编写表单的一个组件首次安装组件时，sources={{}} ，一本空字典。由于该组件包装了现有的 Javascript 库，因此我正在实现一个自定义比较函数。为了让这个 diffing 函数
javascript - 当前 UTC 时间独立于系统时钟吗？
无论系统时间设置为多少以及机器所在的时区，我都需要正确的 UTC 时间。 (即使我必须打电话到互联网才能同步......) 是否有一些库或其他方法可以优雅地做到这一点？最佳答案如果您想获得准确可靠
javascript - 当前 Ajax 请求的最佳实践
我一边编码，一边拿出一些我和 friend 建立的旧网站来重新开始工作。我已经有一段时间没有做过任何 AJAX 了，当我试图找出我的代码失败的地方时，我发现没有显示很多资源。我猜这是因为我使用的是旧方
arm - 当前 CPU 上的分支预测有多普遍？
由于对性能的巨大影响，我从不怀疑我现在的桌面CPU是否有分支预测。当然可以。但各种 ARM 产品又如何呢？ iPhone或Android手机有分支预测吗？较旧的任天堂 DS？基于 PowerPC 的
java - 当前 token 的生命周期
我有一个具有以下有效负载的 JWT: { "id": "394a71988caa6cc30601e43f5b6569d52cd7f6df", "jti": "394a71988caa6cc30
java - JSP 当前 URL
从其他一些帖子中，我能够通过以下方式获取当前 URI: 但是以下方法不起作用: 我很好奇为什么上面的方法不起作用，以及如何将当前 URI 分配给字符串。最佳答案每the javadocs ，g
ios - 当前 View 中单元格的快速高度
我在表格 View 中有几个单元格。现在在任何给定的时间点，我想计算 View 中单元格的当前高度，即如果它是 View 的 3/4，它应该返回 (cellheight)*3/4 高度。我通过以下方
php - 这个登录脚本是否良好/当前/安全？
这是网站的身份验证脚本。这安全吗？是最近的节目吗？它已经过时了吗？是否有“更好更安全的方法”我很新，但我没有看到太多地方使用 header 授权。如有任何帮助，我们将不胜感激!这是我制作的第一个登录
python - 当前 URL 与这些中的任何一个都不匹配
我已经在其他 stackoverflow 线程上检查过这个错误，但在我的代码中没有发现任何错误。也许我累了，但我觉得还好。网站.urls.py: from django.conf.urls impo

首页

博学

6Ren·AI

商城

java - 当前队列负载如何调用Elastic Search？