java - 如何通过 Java API 在 ElasticSearch 中重建索引-6ren

java - 如何通过 Java API 在 ElasticSearch 中重建索引

转载作者：塔克拉玛干更新时间：2023-11-03 04:46:57

40

4

如标题所说...

我读了这篇文章 ( https://www.elastic.co/blog/changing-mapping-with-zero-downtime )，这个概念很棒，但我很难找到关于如何通过 JAVA API 实现它的合适引用。

我找到了这个插件:https://github.com/karussell/elasticsearch-reindex , 但似乎对我正在尝试做的事情有点矫枉过正

最佳答案

在本地一家星巴克进行一些研究后，我得出了以下结论:

假设我们已经有了索引(“old_index”)并且它有数据......现在让我们将该数据移动到我们创建的新索引(“new_index”)(可能使用不同的架构 STRING 与 INT某个字段，或者现在您决定不再希望分析或存储某个字段等)。

这里的基本思想是从现有索引(“old_index”)中检索所有数据并将其提取到新索引(“new_index”)中。但是，您需要做的事情很少:

第一步，你需要执行搜索滚动 https://www.elastic.co/guide/en/elasticsearch/reference/current/search-request-scroll.html

它所做的一切都比常规搜索更有效地检索结果。没有评分等。这是文档必须说的:“滚动不是为了实时用户请求，而是为了处理大量数据，例如为了将一个索引的内容重新索引到一个新索引中具有不同的配置。”

这里是关于如何使用它的 Java API 的链接:https://www.elastic.co/guide/en/elasticsearch/client/java-api/current/scrolling.html

Step 2. 插入时，必须使用bulk ingest。再一次，它是出于性能原因而完成的。这是批量摄取 Java API 的链接:https://www.elastic.co/guide/en/elasticsearch/client/java-api/current/bulk.html#_using_bulk_processor

现在开始实际操作......

第 1 步。设置将从旧索引“加载”数据的滚动搜索

SearchResponse scrollResp = client.prepareSearch("old_index") // Specify index
    .setSearchType(SearchType.SCAN)
    .setScroll(new TimeValue(60000))
    .setQuery(QueryBuilders.matchAllQuery()) // Match all query
    .setSize(100).execute().actionGet(); //100 hits per shard will be returned for each scroll

第 2 步。设置批量处理器。

int BULK_ACTIONS_THRESHOLD = 1000;
int BULK_CONCURRENT_REQUESTS = 1;
BulkProcessor bulkProcessor = BulkProcessor.builder(client, new BulkProcessor.Listener() {
    @Override
    public void beforeBulk(long executionId, BulkRequest request) {
        logger.info("Bulk Going to execute new bulk composed of {} actions", request.numberOfActions());
    }

    @Override
    public void afterBulk(long executionId, BulkRequest request, BulkResponse response) {
        logger.info("Executed bulk composed of {} actions", request.numberOfActions());
    }

    @Override
    public void afterBulk(long executionId, BulkRequest request, Throwable failure) {
        logger.warn("Error executing bulk", failure);
    }
    }).setBulkActions(BULK_ACTIONS_THRESHOLD).setConcurrentRequests(BULK_CONCURRENT_REQUESTS).setFlushInterval(TimeValue.timeValueMillis(5)).build();

Step 3. 通过Step 1创建的scroll searcher从旧索引中读取，直到剩下mo条记录，插入到新索引中

//Scroll until no hits are returned
while (true) {
    scrollResp = client.prepareSearchScroll(scrollResp.getScrollId()).setScroll(new TimeValue(600000)).execute().actionGet();
    //Break condition: No hits are returned
    if (scrollResp.getHits().getHits().length == 0) {
        logger.info("Closing the bulk processor");
        bulkProcessor.close();
        break; 
    }
    // Get results from a scan search and add it to bulk ingest
    for (SearchHit hit: scrollResp.getHits()) {
        IndexRequest request = new IndexRequest("new_index", hit.type(), hit.id());
        Map source = ((Map) ((Map) hit.getSource()));
        request.source(source);
        bulkProcessor.add(request);
   }
}

第 4 步。现在是时候将指向旧索引的现有别名分配给新索引了。然后删除对旧索引的别名引用，然后删除旧索引本身。要了解如何确定分配给现有旧索引的别名，请参阅此帖子:ElasticSeach JAVA API to find aliases given index

为新索引分配别名

client.admin().indices().prepareAliases().addAlias("new_index", "alias_name").get();

从旧索引中删除别名，然后删除旧索引

client.admin().indices().prepareAliases().removeAlias("old_index", "alias_name").execute().actionGet();
client.admin().indices().prepareDelete("old_index").execute().actionGet();

关于java - 如何通过 Java API 在 ElasticSearch 中重建索引，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/31345586/

40

4

0

文章推荐： java - 在 Java 8 中对两个 ArrayList 进行乘法和求和

文章推荐： JavaFX ChangeListener 并不总是有效

文章推荐：来自模板化对象的 Java 8 功能构造函数

Oracle 更改索引/重建
如果我使用 alter index x rebuild 重建不可用的索引，是否会重新评估之前使用该索引的任何 SQL 的执行计划？我知道在我使用的数据库版本 - Oracle 10.2.0.4.0
从校准的相机图像进行 3d 重建
我正在研究 3d 重建。现在当我考虑一对图像时。我有一组对应点。我有我的相机详细信息。例如我有焦点细节，旋转和平移矩阵(4 * 4)。我想在 3D(三角剖分)中投影我的点。因此，据我所知，因子代数非常
python - 重建:为什么不扭曲图像并标准化坐标？
从教程中:https://programtalk.com/vs2/?source=python/8176/opencv-python-blueprints/chapter4/scene3D.py 我不
opencv - 2d图像到3d(重建)
我需要您的帮助和建议。这个问题包括以下几项:某房间的照片，该房间站在严格固定位置的房间内(一个房间围绕轴线旋转)。如何将所有这些图片组合在一起，从而产生一种效果，就像我们用眼睛看到的一样？从一点开始就
c - 重建/更新内核模块
嘿那里，以下问题:我在工作中使用一个相当奇怪的 Linux 发行版(Centos 5)，它似乎有一个较旧的内核(或者至少在内核中存在一些差异)，并且您不能简单地更新它。我需要安装的程序需要一个函数 c
statistics - 受限玻尔兹曼机 - 重建
我读了一些关于受限玻尔兹曼机的文章。这些机器的重建能力经过了测试。我了解训练是如何进行的，但不了解重建是如何完成的。有人可以给我一些提示吗？最佳答案杰夫·辛顿 (Geoff Hinton) 的演讲
ios - 重建/重置核心数据时出错
如果轻量级迁移失败，我将尝试重建核心数据数据堆栈，并将用户送回登录屏幕。我正在通过将一对多关系更改为一对一关系来对此进行测试。起初，我在删除新的 persistentStoreCoordinator
MySQL索引操作命令总结（创建、重建、查询和删除索引命令详解）
以下所列示例中中 `table_name` 表示数据表名，`index_name` 表示索引名，column list 表示字段列表（如：`id`,`order_id`）。 1、创建索引索引的
Flutter - 避免 ListView 重建
当您根据 ListView.builder 和 ListView.separated valueKey = key; return _messages
flutter - 切换页面时防止谷歌地图 flutter 重建
切换底部导航页面后，我有一个非常烦人的谷歌地图 flutter 重建问题。我已经坚持了最后一次缩放和相机位置，但是每次我进入 map 页面时，小部件都会自行重建。如何预防？最佳答案采用 Autom
python - 重建 Pandas 数据框
我是 Python 的新手。我在重建一个错误的 Dataframe 时遇到了麻烦。我的数据框如下所示: df = pd.DataFrame({'col1': ['id 1', 'id 2', 'tes
MATLAB:使用八点算法进行 3d 重建
我正在尝试从 2 个图像中实现 3d 重建。我遵循的步骤是， 1. Found corresponding points between 2 images using SURF. 2. Impleme
javascript - 重建 Json 列表
// Start with this JSON var initialJson = { "rows": [{ "ID": 123, "Data": 430910, "Ver
flutter - 有条件地停止 child 重建
在有状态的小部件中，我有一个导航部分，用户可以在其中选择父项，并在子项下方显示。当我选择父级也可以重建子部件时，但是当我导航抛出父项而不选择一个子部件时，父级也可以重建(这是正常的)，但是子部件也可
3d - 脸部 3D 重建
我有一个网络摄像头，它可以围绕人的头部以给定的角度步长旋转，并为每一步获取一张图片。我正在寻找一个免费的开源库，该库从获取的图像集开始，使我能够生成代表人头部的 3D 表面，或者至少是定义明确的 3
csv - 重建 CSV 并使用字段值作为导出的文件名
我想从一行中读取一个字符串，然后将其放入一个变量中，该变量随后用作文件名。该字符串位于 .csv 文件中的第二行末尾。由于不必要的标题，需要删除第一行。还有‘;’旧 .csv 文件中使用的内容需要替换
haskell - 嵌入文件更改后的 Cabal 重建
我正在使用file-embed如此封装: import qualified Data.ByteString as B import qualified Data.ByteString.Internal
c - 重建 makefile 即使它是最新的
我的 makefile 总是重建，不明白为什么.. 这里是: SRC = $(DIR)/my_getnbr.c \ $(DIR)/my_isneg.c \ $(DI
java - 重建 Eclipse 编辑器
我有一个附带编辑器的 Eclipse 插件。我添加了更改语法突出显示颜色的首选项，但这些更改仅在我手动重新启动编辑器后才适用。我通过一个 DefaultDamagerRepairer 实现了语法高
jquery - 重建 DIV id
我有一段 php 可以输出 div(取决于数组中有多少个)并为该 div 分配一个 id(即 div_1、div_2)等我还设置了一个隐藏字段，其中包含输出了多少个 div 的计数(divcount

首页

博学

6Ren·AI

商城

java - 如何通过 Java API 在 ElasticSearch 中重建索引