python - 贝叶斯优化应用于 CatBoost-6ren

python - 贝叶斯优化应用于 CatBoost

转载作者：太空宇宙更新时间：2023-11-04 00:09:42

33

4

这是我在 CatBoost 中应用 BayesSearch 的尝试:

from catboost import CatBoostClassifier
from skopt import BayesSearchCV
from sklearn.model_selection import StratifiedKFold


# Classifier
bayes_cv_tuner = BayesSearchCV(
estimator = CatBoostClassifier(
silent=True
),
search_spaces = {
'depth':(2,16),
'l2_leaf_reg':(1, 500),
'bagging_temperature':(1e-9, 1000, 'log-uniform'),
'border_count':(1,255),
'rsm':(0.01, 1.0, 'uniform'),
'random_strength':(1e-9, 10, 'log-uniform'),
'scale_pos_weight':(0.01, 1.0, 'uniform'),
},
scoring = 'roc_auc',
cv = StratifiedKFold(
n_splits=2,
shuffle=True,
random_state=72
),
n_jobs = 1,
n_iter = 100,
verbose = 1,
refit = True,
random_state = 72
)

跟踪结果:

def status_print(optim_result):
"""Status callback durring bayesian hyperparameter search"""

# Get all the models tested so far in DataFrame format
all_models = pd.DataFrame(bayes_cv_tuner.cv_results_)    

# Get current parameters and the best parameters    
best_params = pd.Series(bayes_cv_tuner.best_params_)
print('Model #{}\nBest ROC-AUC: {}\nBest params: {}\n'.format(
    len(all_models),
    np.round(bayes_cv_tuner.best_score_, 4),
    bayes_cv_tuner.best_params_
))

拟合贝叶斯CV

resultCAT = bayes_cv_tuner.fit(X_train, y_train, callback=status_print)

结果

前 3 次迭代工作正常，但随后我得到一个不间断的字符串:

Iteration with suspicious time 7.55 sec ignored in overall statistics.

Iteration with suspicious time 739 sec ignored in overall statistics.

(...)

关于我哪里出错的任何想法/我该如何改进？

敬礼，

最佳答案

根据 CatBoost 迄今为止记录的时间，skopt 正在安排的一组实验中的一个迭代实际上花费了太长时间才能完成。

如果您通过设置分类器的详细程度来探索何时发生这种情况，并使用回调来探索 skopt 正在探索的参数组合，您可能会发现罪魁祸首很可能是深度参数:当 CatBoost 时，Skopt 会变慢正在尝试测试更深的树。

您也可以尝试使用此自定义回调进行调试:

counter = 0
def onstep(res):
    global counter
    args = res.x
    x0 = res.x_iters
    y0 = res.func_vals
    print('Last eval: ', x0[-1], 
          ' - Score ', y0[-1])
    print('Current iter: ', counter, 
          ' - Score ', res.fun, 
          ' - Args: ', args)
    joblib.dump((x0, y0), 'checkpoint.pkl')
    counter = counter+1

您可以通过以下方式调用它:

resultCAT = bayes_cv_tuner.fit(X_train, y_train, callback=[onstep, status_print])

实际上，我在实验中注意到了与您相同的问题，随着深度的增加，复杂性以非线性方式增加，因此 CatBoost 需要更长的时间来完成其迭代。一个简单的解决方案是尝试搜索更简单的空间:

'depth':(2, 8)

通常深度 8 就足够了，无论如何，您可以先以最大深度等于 8 运行 skopt，然后通过增加最大值重新迭代。

关于python - 贝叶斯优化应用于 CatBoost，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/52989242/

33

4

0

文章推荐： node.js - Nodejs 安全 Cook 和 HTTPOnly 在代理服务器后面

文章推荐： html - 在表内有一个元素但在 td 之外

文章推荐： c - 从邻接矩阵中删除顶点的好方法

文章推荐： c# - ASP.NET 网站在 IE10 上看起来不同

r - 应用于 3 个变量的数据框转换
我写了几个命令来转换数据框，但我想将我写的代码简化为四个部分。第 1,2 和 3 部分用于计算第 1、2 和 3 列(计算每列重复值的次数，并完成 0 和三列最大值之间的缺失数)。第四部分是加入前面的
scala - 应用于 Scala 函数的类型参数
我试图理解应用于函数的类型参数。我想在下面的方法中使用通用类型，但为了我的理解使用 String 和 Int。当我如下定义一个函数时 def myfunc[Int](f:String => I
应用于 DIV 内容的 CSS
我有一个像下面这样的 DIV: // link to some js .js 在 div 中呈现最新的文章摘要。然而，它在 Calibri
gridview - 应用于 gridview 中的边界字段的格式不起作用
我在 GridView 中有以下列，一列是日期，另一列是美元金额。我应用了格式并将 HtmlEncode 属性设置为 false，但值仍然未格式化: 这就是这些值在 GridView 中的显示方式
haskell - 应用于 Haskell 中标记类型的通用函数
假设我已经定义了这些类型: data Km = Km Float deriving (Show, Eq) data Mile = Mile Float deriving (Show, Eq
haskell - 关于上下文中的值(应用于 Monad)
我有一个关于 value in context 的小问题。取 Just 'a'，所以在这种情况下 Maybe 类型上下文中的值是 'a' 采用[3]，因此在这种情况下，[a] 类型上下文中的值为3
rollapply 应用于 xts 对象
require(quantmod) require(PerformanceAnalytics) getSymbols('INTC') x<- monthlyReturn(INTC) rollapply
vba - 应用于 Word 修订版的更改使两个段落合二为一
我正在使用 VBA 对“已应用字轨更改”文档进行更改。红色段落结束标记是插入段落结束标记。(打开“跟踪更改”> 将光标放在第一段末尾 > 按 Enter > 插入新段落内容 > 格式风格不同) 我需
c++ - 应用于 const 和非常量对象的引用返回方法
考虑以下代码: class A{ my_method(const B& b){ import_something_from_c(this, b.getC()); // does some
ios - 应用于 Material 时像素化图像纹理
我正在为自定义 Material 分配图像。分配的图像看起来有点像素化，类似于此图像我已经将抗锯齿设置为 4 倍。我该如何解决这个问题？最佳答案尝试将 Material 的 mipFilter
css - 应用于 HTML 元素的样式总是被覆盖
我将样式应用于元素和元素。是否可以在上使用样式元素应用于似乎不遵循 CSS 特异性的通常规则。这是真的吗？示例:http://jsfiddle.net/59dpy/ 尝试将所有背景色设为红
html - 应用于 TD 时垂直虚线边框不均匀
有没有办法将垂直虚线边框应用于没有他们(边界)合并？我说的是附图上的东西——有 3 个这里的元素，每个元素包含 2 的。如果我申请 border-right: 1px dashed black到
html - 应用于 body 时线性渐变不起作用
当我在 CSS 中对主体应用线性渐变时，如下所示 body { background: linear-gradient(#10416b, black); } 它不会将它应用到整个网页，而是将它应用到页
css - 应用于 td 的边界半径没有内半径
当我将边框和边框半径应用于 td 时，内半径是一个直 Angular ，根本不是圆的。最佳答案问题很可能是背景不透明的子元素会剪掉边框的内半径。要解决此问题，您可以在 td 上应用 overfl
CSS 应用于 SVG 组元素但不在使用时
基本上，我有一个小的 SVG，它使用一个组来定义一个可重用的符号。该组包括我想在 CSS 中设置动画的路径。我面临的问题是只有“原始”元素应用了 CSS，“使用过”的元素没有。 .player_arr
html - 应用于 td 的宽度属性
宽度属性在这里不起作用: td { height: 50px; width: 25px; border: 1px
Java:应用于 Map 泛型类型的多态性
我想要一个函数(例如)在两种情况下输出 Map 的所有值: Map map1 = new HashMap(); Map map2 = new HashMap(); output(map1, "1234
java - 应用于 AlertDialog 的样式无法正常工作
我被要求将我们应用中的警报对话框的外观与应用主题使用的外观相匹配。我设法将样式应用于应用程序中的所有警报对话框，并将其用作应用程序主题的一部分，但有些情况下样式应用不正确。例如，当警报对话框包含“
ios - 应用于 CGPath 的比例变换会影响渲染质量吗？
我有一个 CGPath(由 UIBezierPath 创建)，我想通过应用 CGAffineTransformScale 将其缩放到我想要的任何大小。这会影响我的绘图质量(在转换为图像时)吗？如果不
c++:应用于 vector 的STL算法也适用于其他容器对象吗？
您好，我已经在 vector 上使用了一些 STL 算法，例如 find_if、count_if、sort、push_back 等。现在我想为所有容器对象( vector 、列表、映射、集合)制作一个

首页

博学

6Ren·AI

商城

python - 贝叶斯优化应用于 CatBoost