r - lin 的留一法 CV 实现。回归-6ren

r - lin 的留一法 CV 实现。回归

转载作者：行者123 更新时间：2023-11-30 09:10:09

27

4

我正在 cafe 上构建线性回归数据集，我想通过计算留一交叉验证来验证结果。

我为此编写了自己的函数，如果我将 lm() 拟合到所有数据上，该函数就可以工作，但是当我使用列的子集(来自逐步回归)时，我收到错误。考虑以下代码:

cafe <- read.table("C:/.../cafedata.txt", header=T)

cafe$Date <- as.Date(cafe$Date, format="%d/%m/%Y")

#Delete row 34
cafe <- cafe[-c(34), ]
#wont need date
cafe <- cafe[,-1]

library(DAAG)
#center the data
cafe.c <- data.frame(lapply(cafe[,2:15], function(x) scale(x, center = FALSE, scale = max(x, na.rm = TRUE))))
cafe.c$Day.of.Week <- cafe$Day.of.Week
cafe.c$Sales <- cafe$Sales

#Leave-One-Out CrossValidation function
LOOCV <- function(fit, dataset){
  # Attributes:
  #------------------------------
  # fit: Fit of the model
  # dataset: Dataset to be used
  # -----------------------------
  # Returns mean of squared errors for each fold - MSE
  MSEP_=c()

  for (idx in 1:nrow(dataset)){
    train <- dataset[-c(idx),]
    test <- dataset[idx,]

    MSEP_[idx]<-(predict(fit, newdata = test) -  dataset[idx,]$Sales)^2
  }
  return(mean(MSEP_))
}

然后，当我拟合简单的线性模型并调用该函数时，它就起作用了:

#----------------Simple Linear regression with all attributes-----------------
fit.all.c <- lm(cafe.c$Sales ~., data=cafe.c)

#MSE:258
LOOCV(fit.all.c, cafe.c)

但是，当我仅将相同的 lm() 与列的子集配合时，我收到错误:

#-------------------------Linear Stepwise regression--------------------------
step <- stepAIC(fit.all.c, direction="both")

fit.step <- lm(cafe.c$Sales ~ cafe.c$Bread.Sand.Sold + cafe.c$Bread.Sand.Waste
               + cafe.c$Wraps.Waste + cafe.c$Muffins.Sold 
               + cafe.c$Muffins.Waste + cafe.c$Fruit.Cup.Sold 
               + cafe.c$Chips + cafe.c$Sodas + cafe.c$Coffees 
               + cafe.c$Day.of.Week,data=cafe.c)

LOOCV(fit.step, cafe.c)

5495.069

There were 50 or more warnings (use warnings() to see the first 50)

如果我仔细观察:

idx <- 1
train <- cafe.c[-c(idx)]
test <- cafe.c[idx]

(predict(fit.step, newdata = test) -cafe.c[idx]$Sales)^2

我得到所有行的 MSE 和错误:

Warning message: 'newdata' had 1 row but variables found have 47 rows

编辑

我找到了this关于错误的问题，它说当我为列提供不同的名称时会发生此错误，但事实并非如此。

最佳答案

更改您的代码，如下所示:

fit.step <- lm(Sales ~ Bread.Sand.Sold + Bread.Sand.Waste
               + Wraps.Waste + Muffins.Sold 
               + Muffins.Waste + Fruit.Cup.Sold 
               + Chips + Sodas + Coffees 
               + Day.of.Week,data=cafe.c)

LOOCV(fit.step, cafe.c)
# [1] 278.8984

idx <- 1
train <- cafe.c[-c(idx),]
test <- cafe.c[idx,] # need to select the row, not the column

(predict(fit.step, newdata = test) -cafe.c[idx,]$Sales)^2
#    1 
# 51.8022

此外，您的LOOCV实现不正确。每次都必须在火车数据集的 left-1-out 折叠上拟合一个新模型。现在，您正在整个数据集上训练模型一次，并使用相同的单个模型来计算每个留一折叠的保留测试数据集的 MSE，但理想情况下您应该有不同的模型在不同的训练数据集上进行训练。

关于r - lin 的留一法 CV 实现。回归，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/41543279/

27

4

0

文章推荐： machine-learning - 在 MXNet 上运行 Ptr-Net

文章推荐： machine-learning - LibSVM - 具有不平衡数据的多类分类

文章推荐： python - Tensorflow CNN 模型出现错误 "NaN loss during training."

cookies - 移动应用程序 - Cookie 法
关闭。这个问题不符合Stack Overflow guidelines .它目前不接受答案。想改进这个问题？将问题更新为 on-topic对于堆栈溢出。 6年前关闭。 Improve this qu
java - 实体惰性方法和 Dimetra 法
我有实体: @Entity @Table(name = "CARDS") public class Card { @ManyToOne @JoinColumn(name = "PERSON_I
javascript - 计算多边形的法向量 - Newells 法
我正在尝试计算二维多边形的表面法线。我正在使用 OpenGL wiki 中的 Newell 方法来计算表面法线。 https://www.opengl.org/wiki/Calculating_a_S
jquery - 着陆页上的谷歌分析代码和 cookie 法
关闭。这个问题不符合Stack Overflow guidelines .它目前不接受答案。这个问题似乎与 help center 中定义的范围内的编程无关。 . 关闭 7 年前。 Improve
android - 移动应用程序是否需要遵守欧盟 Cookie 法？
关闭。这个问题是off-topic .它目前不接受答案。想改进这个问题吗？ Update the question所以它是on-topic用于堆栈溢出。关闭 9 年前。 Improve this
ruby - Nokogiri child 法
我这里有以下 XML: Visa, Mastercard, , , , 0, Discover, American Express siteonly, Buyer Pay
Android - 欧盟 Cookie 法
即将发生的 Google 政策变更迫使我们实现一个对话框，以通知欧盟用户有关 Cookie/设备标识符用于广告和分析的情况。我只想向欧盟用户显示此对话框。我不想使用额外的权限(例如 android.p
华为云大咖说：开发者应用AI大模型的“道、法、术”
本文分享自华为云社区《华为大咖说 | 企业应用AI大模型的“道、法、术” ——道：认知篇》，作者：华为云PaaS服务小智。本期核心观点上车：AGI是未来5～10年内，每个人都无法回避的技
asp.net - 关于年龄验证的 Cookie 法
我有一个与酒精相关的网站，需要先验证年龄，然后才能让他们进入该网站。我使用 HttpModule 来执行此操作，该模块检查 cookie，如果未设置，我会将它们重定向到验证页面。我验证他们的年龄并存储
javascript - 自动选择加入 cookie 的浏览器插件 - 欧盟 cookie 法
在欧盟，我们有一项法律，要求网页请求存储 cookie 的许可。我们大多数人都了解 cookie 并同意它们，但仍然被迫在任何地方明确接受它们。所以我计划编写这个附加组件(ff & chrome)，它
c++ - 在 C/C++ 中声明函数然后定义它是否内 union 法？
以下在 C 和/或 C++ 中是否合法？ void fn(); inline void fn() { /*Do something here*/ } 让我担心的是，第一个声明看起来暗示函数将被定义

首页

博学

6Ren·AI

商城

r - lin 的留一法 CV 实现。回归