R:xgboost绘制roc曲线-6ren

R:xgboost绘制roc曲线

转载作者：行者123 更新时间：2023-11-30 08:32:00

26

4

绘制 roc 曲线:

library(ROCR)
<data cleaning/scrubbing>
<train data>
.....
.....
rf.perf = performance(rf.prediction, "tpr", "fpr") #for RF
logit.perf = performance (logit.prediction, "tpr", "fpr") #for logistic reg
tree.perf = performance(tree.prediction, "tpr", "fpr") #for cart tree
...
plot(re.perf) #a RF roc curve

如果我想运行 xgboost 分类并随后绘制 roc:目标=“二进制:物流”

我对 xgboost 的参数感到困惑指标“auc”( CRAN manual 第 9 页)，它说的是面积。如何用 tpr 和 fpr 绘制曲线进行模型比较？

我尝试在网络和 github 上搜索，最强调的是功能重要性图(针对 xgboost)。

谢谢

最佳答案

先说ROC曲线

The ROC curve is created by plotting the true positive rate (TPR) against the false positive rate (FPR) at various threshold settings.

在 python 中，可以轻松完成:

from sklearn import metrics
def buildROC(target_test,test_preds):
    fpr, tpr, threshold = metrics.roc_curve(target_test, test_preds)
    roc_auc = metrics.auc(fpr, tpr)
    plt.title('Receiver Operating Characteristic')
    plt.plot(fpr, tpr, 'b', label = 'AUC = %0.2f' % roc_auc)
    plt.legend(loc = 'lower right')
    plt.plot([0, 1], [0, 1],'r--')
    plt.ylabel('True Positive Rate')
    plt.xlabel('False Positive Rate')
    plt.gcf().savefig('roc.png')

enter image description here

例如上图中，在一定的阈值下，以假阳性率 0.2 为代价，我们可以获得接近 0.96 - 0.97 的真阳性

A good documentation on ROC

关于R:xgboost绘制roc曲线，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/33518129/

26

4

0

文章推荐： javascript - 无法使用javascript查找没有空格的字符串长度

文章推荐： java - scenebulider 无法打开 fxml 文件

文章推荐： javascript - 如何计算给定日期是今天还是昨天？

r - 绘制多条 ROC 曲线的平均 ROC 曲线，R
我有一个包含 100 个样本的数据集，每个样本都有 195 个突变，具有相应的已知临床意义(“RealClass”)和根据某些预测工具的预测值(“PredictionValues”) 为了演示，这是一
machine-learning - Keras ROC 与 Scikit ROC 不同？
从下面的代码中，看起来使用 keras 和 scikit 评估 roc 实际上有所不同。有人知道解释吗？ import tensorflow as tf from keras.layers impor
使用 multiclass.roc 的 R 多类/多项式分类 ROC(包 ‘pROC’)
我很难理解 multiclass.roc 参数应该是什么样子。这是我的数据快照: > head(testing.logist$cut.rank) [1] 3 3 3 3 1 3 Levels: 1 2
ROC 曲线看起来不正确
我已经使用 ROCR 包绘制了 2 类问题的 ROC 曲线。根据我的理解，至少对于较小的数据集，曲线应该看起来像阶跃变化图。我的输入实际上很小，但我得到的曲线基本上看起来是直线。是因为 PROC 适合
r - 优化插入符号的灵敏度似乎仍然优化 ROC
我正在尝试使用 rpart 在插入符号中最大限度地提高模型选择的灵敏度。为此，我尝试复制此处给出的方法(向下滚动到使用用户定义函数 FourStat 的示例)caret's github page #
r - "ROC"指标不在结果集中
我正在尝试使用插入符包生成随机森林模型，使用 ROC 曲线下的面积作为训练指标，但我收到以下警告: Warning message: In train.default(x = TrainData, y
用于随机森林分类的 ROC 曲线
我在 R 平台中使用 randomForest 包进行分类任务。 rf_object<-randomForest(data_matrix, label_factor, cutoff=c(k,1-k))
R 插入符保留样本和测试集 ROC
我正在构建两个不同的分类器来预测二进制结果。然后我想通过使用 ROC 曲线及其下面积 (AUC) 来比较两个模型的结果。我将数据集分为训练集和测试集。在训练集上，我执行一种形式的交叉验证。从交叉验证
python - 如何计算多类交叉验证的平均 ROC
我最近在为我的项目使用 sklearn 时遇到困难。我想构建一个分类器并将我的数据分为六组。总样本量为 88 然后我将数据分成 train(66) 和 test(22)我完全按照 sklearn 文档
python - 用于多类分类的 ROC
我正在进行不同的文本分类实验。现在我需要计算每个任务的 AUC-ROC。对于二进制分类，我已经使用以下代码使其工作: scaler = StandardScaler(with_mean=False)
python - 绘制多类问题的 ROC 曲线
我正在尝试应用 sklearn 的想法 ROC extension to multiclass到我的数据集。我的每类 ROC 曲线看起来都找到了一条直线，取消显示曲线波动的 sklearn 示例。我
r - 如何为不同的插入符号训练模型绘制 AUC ROC？
这是一个代表 library(caret) library(dplyr) set.seed(88, sample.kind = "Rounding") mtcars % mutate(am = a
r - 从数据框中手动创建 ROC 曲线
我有以下概念问题，我无法理解。以下是调查数据示例，其中我有一个时间列，指示某人需要多长时间才能回答某个问题。现在，我感兴趣的是清洁量将如何根据此阈值发生变化，即如果我增加阈值会发生什么，如果我降低
c - 误报概率图和 ROC 曲线
如何为使用视频的对象检测应用绘制每个窗口的误报率与未命中率(或误报概率)和 ROC(接收器操作曲线)的图表？如何确定误报和命中的数量？一个例子是很有用。最佳答案它很简单。将所有真正 (H0) 值存
r - 从随机森林分类中绘制 ROC 曲线
我正在尝试绘制随机森林分类的 ROC 曲线。绘图有效，但我认为我绘制了错误的数据，因为生成的绘图只有一个点(准确性)。这是我使用的代码: set.seed(55) data.controls <
r - 使用插入符号中的提升从两种不同的算法绘制 ROC 曲线
我有如下两个模型: library(mlbench) data(Sonar) library(caret) set.seed(998) my_data <- Sonar fitControl <-
ROC 的 R 编码
我很难将 ROC 的示例命令转换为我的数据集。这是用于 pROC 包这是使用数据(aSAH)的例子 roc(aSAH$outcome, aSAH$s100b) roc(outcome ~ s100b
多类 kNN 中的 ROC
我试图在多类 knn 模型和数据集上运行一些 ROC 分析到目前为止，我有 kNN 模型的这段代码。它运作良好。X_train_new是一个包含 131 个数值变量(列)和 7210 个观测值的数据
classification - 过度拟合和 ROC 曲线
是否可以仅通过查看其 ROC 曲线来了解分类器是否过度拟合？我看到如果它的 AUC 太高(例如 98%)可能会过度拟合，但这也可能意味着分类器非常好。有没有办法区分这两种情况？最佳答案简短的回答:
r - 更改 ROC 图表的比例
在运行逻辑回归后，我使用以下代码绘制 ROC 曲线。 fit1 <- glm(formula=GB160M3~Behvscore, data=eflscr,family="binomial", na.

首页

博学

6Ren·AI

商城

R:xgboost绘制roc曲线