python - 如何为 xgboost 实现增量训练？-6ren

python - 如何为 xgboost 实现增量训练？

转载作者：IT老高更新时间：2023-10-28 22:20:55

44

4

问题是由于火车数据大小，我的火车数据无法放入 RAM。所以我需要一种方法，首先在整个火车数据集上构建一棵树，计算残差构建另一棵树等等(就像梯度提升树一样)。显然，如果我在某个循环中调用 model = xgb.train(param, batch_dtrain, 2) - 这将无济于事，因为在这种情况下，它只会为每个批处理重建整个模型。

最佳答案

在第一批训练后尝试保存您的模型。然后，在连续运行时，为 xgb.train 方法提供已保存模型的文件路径。

这是我进行的一个小实验，以说服自己它有效:

首先，将波士顿数据集拆分为训练集和测试集。然后将训练集分成两半。用前半部分拟合一个模型，得到一个作为基准的分数。然后用后半部分拟合两个模型；一个模型将具有附加参数 xgb_model。如果传入额外的参数没有影响，那么我们希望他们的分数是相似的..但是，幸运的是，新模型的性能似乎比第一个要好得多。

import xgboost as xgb
from sklearn.cross_validation import train_test_split as ttsplit
from sklearn.datasets import load_boston
from sklearn.metrics import mean_squared_error as mse

X = load_boston()['data']
y = load_boston()['target']

# split data into training and testing sets
# then split training set in half
X_train, X_test, y_train, y_test = ttsplit(X, y, test_size=0.1, random_state=0)
X_train_1, X_train_2, y_train_1, y_train_2 = ttsplit(X_train, 
                                                     y_train, 
                                                     test_size=0.5,
                                                     random_state=0)

xg_train_1 = xgb.DMatrix(X_train_1, label=y_train_1)
xg_train_2 = xgb.DMatrix(X_train_2, label=y_train_2)
xg_test = xgb.DMatrix(X_test, label=y_test)

params = {'objective': 'reg:linear', 'verbose': False}
model_1 = xgb.train(params, xg_train_1, 30)
model_1.save_model('model_1.model')

# ================= train two versions of the model =====================#
model_2_v1 = xgb.train(params, xg_train_2, 30)
model_2_v2 = xgb.train(params, xg_train_2, 30, xgb_model='model_1.model')

print(mse(model_1.predict(xg_test), y_test))     # benchmark
print(mse(model_2_v1.predict(xg_test), y_test))  # "before"
print(mse(model_2_v2.predict(xg_test), y_test))  # "after"

# 23.0475232194
# 39.6776876084
# 27.2053239482

引用:https://github.com/dmlc/xgboost/blob/master/python-package/xgboost/training.py

关于python - 如何为 xgboost 实现增量训练？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/38079853/

44

4

0

文章推荐： python - alembic 修订 - 多头(由于分支)错误

文章推荐： C++ CRTP 和从基访问派生的嵌套类型定义

文章推荐： java - Android NDK - 只能用 C/C++ 编写

文章推荐： python - 使用 Python 从字符串中删除不间断空格

Java 增量 i = i++;
这个问题已经有答案了: What is x after "x = x++"? (18 个回答) 已关闭 6 年前。 public static void main(String[] args)
jQuery循环插件交错/增量
我目前正在使用 jquery 循环插件。我有 3 个不同的幻灯片，它们彼此相邻并同时循环播放。我想做的是先关闭第一张幻灯片，然后是第二张幻灯片，然后是第三张幻灯片。无论如何，我可以通过增量或超时来做到
JavaScript 增量
这个问题在这里已经有了答案: 关闭 11 年前。 Possible Duplicate: ++someVariable Vs. someVariable++ in Javascript 我知道您可以
svn --增量 : How to use it and what it does?
我一直在查看 SVN 手册，但无法找到“svn log”和“svn st”的“--incremental”选项的简单用法示例或解释。我正在编写一个开源 SVN GUI 前端，因此我需要一些有关此标志
r - 从矩阵的对角线计算平均值 + 增量
我有这种矩阵。非常抱歉，我没有可重现的示例。表 1: [,1][,2][,3][,4][,5][,6][,7][,8][,9][,10] [1,] 3 NA NA NA
dataframe - 使用数据框在Spark中处理数据差异(增量)
我在hdfs中有一个 Parquet 文件作为我的数据的初始加载。接下来的所有拼花地板只是这些数据集每天都会更改为初始负载(按时间顺序)。这是我的三角洲。我想读取全部或部分 Parquet 文件，以
Javascript Ceil 增量
我目前有这样的功能，可以将任何输入数字四舍五入到最接近的模糊整数值: $(function(){ $('#my_value').blur(function() { $(this).va
c - 如何设计循环数列(增量)？
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。要求提供代码的问题必须表现出对所解决问题的最低限度的了解。包括尝试的解决方案、为什么它们不起作用以及预期结果
java - SQL检查3列+增量
我对 SQL 还很陌生，我想知道我是否可以使用它来自动解决我数据库中的一个复杂问题。也就是说，我每天都在跟踪条目。因此，我们关注的列是: YYYY MM DD XXX YYYY 是年，MM 是月，D
mysql - 数据透视表以外的其他方式 - 增量
我正在开发一个非常简单的数据库，但我不知道数据透视表是否是一个很好的解决方案。如果我使用数据透视表，我需要添加无用的表只是为了增量。让我们从头开始。在用户注册期间，会创建一个新表 GROUP。在G
mysql - 选择查询中的临时变量赋值/增量
在 MySQL 中你可以做这样的事情 SELECT @n := @n + 1 n, first_name, last_name FROM table1, (SELECT
C++增量++运算符重载
如果我正在使用一个类，我知道如何重载运算符 += class temp { public: int i; temp(){ i = 10; } int operator+=(in
Linux Grep 增量
我有两个文件:file1、file2。我想从 file2 中获取 file1 中不存在的行。我读过 post这告诉我使用 grep 的 -v 标志来执行此操作(我阅读了 grep 的手册页，但仍然不
python - 如何使用python日期时间函数/增量？
我看了很多类似的题，功能很简单，用于API的嵌套for循环，每分钟可以调用5次。所以我将一年数据的范围设置为 75。你们能帮我解决这个问题吗？提前致谢! 第一部分正在运行，输入列表中的邮政编码。 fo
python - 计算数据框的每日返回/增量
所以我想计算每日返回/增量的一些时间序列数据，其中每日增量 = value_at_time(T)/value_at_time(T-1) import pandas as pd df=pd.DataFr
c++ - 增量、前增量和后增量
请帮我解决这个问题。该表达式之后的步骤是: //Expression offSpring1[m1++] = temp1; //Steps: 1.- increment m1 2.- assign te
java - 增量/选择性同步远程系统
我正在开发一个解决方案，在该解决方案中，我通过 webapp 不同类型的实体(例如中央数据库上的用户、组、部门信息)和 ldap 进行身份验证。但是最终用户将与来自远程位置(他的办公室、节点)的数据交
python - 获取两个字典列表之间的差异(增量)
我有以下 Python 数据结构: data1 = [{'name': u'String 1'}, {'name': u'String 2'}] data2 = [{'name': u'String
java - AtomicInteger 增量
如果 AtomicInteger 会发生什么？达到 Integer.MAX_VALUE 并递增？值会回到零吗？最佳答案由于integer overflow，它会环绕, 到 Integer.MIN
c - 0.00001 增量
我是 C 的初学者，我正在尝试在 While 循环中进行 0.00001 增量。例如，double t = 0.00001 并且我希望循环每次以 0.00001 的增量运行，第二次是 0.00002

首页

博学

6Ren·AI

商城

python - 如何为 xgboost 实现增量训练？