- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我对下面的代码有疑问,我正在努力理解:
x = rnorm(50)
y = 3 * x +rnorm(50)
df_eq <- data.frame(x, y)
model1 <- lm(y ~ x - 1)
model2 <- lm(df_eq[,2] ~ df_eq[,1] - 1)
xpred <- data.frame(x = seq(from = -2, to = 2, length = 5))
ypred <- predict(object = model1, newdata = xpred)
ypred2 <- predict(object = model2, newdata = xpred)
在上面的代码中,我希望 ypred 和 ypred2 产生相同的结果。我在 ypred 中得到了我期望的答案(5 个预测的“yhat”值),但是 ypred2 有一个错误,并且没有产生预期的结果。
谁能解释为什么在下面的代码中 ypred2 会产生错误(至少在 R 2.15.2 中)?
我认为代码中唯一的关键区别在于生成“model1”和“model2”的方式。
我的理解是,在 predict 函数中,newdata 根据存储在 model1 和 model2 对象中的模型生成我们想要为其预测“yhat”值的新观察集。
有什么根本的不同
模型 1 <- lm(y ~ x - 1)
和
model2 <- lm(df_eq[,2] ~ df_eq[,1] - 1) ?
更重要的是,如果答案很简单,有人能解释一下他们是如何从 R 的“幕后”找出差异的吗?很高兴知道我将来如何理解这类问题。我已尝试查看上述代码中对象的结构,但离答案还差得很远。
提前谢谢你。
最佳答案
从 R 的角度来看,您将对象 model2
交给了 predict.lm
。它说,“好的,我这里有一个 lm
对象。变量名是什么?”
> formula(model2)
df_eq[, 2] ~ df_eq[, 1] - 1
好的。响应变量调用 df_eq[, 2]
预测变量调用 df_eq[, 1]
。现在,R 认为:“我应该在 xpred
中找到那些变量(或至少是预测变量)”。
嗯嗯。里面没有那个名字。
实际警告是由 model.frame.default
抛出的,我相信,在尝试构建适当的模型框架时,并在此过程中回退到用于拟合模型的原始数据值.
通常(lm
或其他)拟合模型的正确习惯用法是这样的:
lm(y ~ x, data = df_eq)
不要依赖 R 获取全局环境中对象的名称。指定具有相关列的数据框,并在公式中使用这些列名称!
关于r - 为什么 R 在以下代码中使用 lm.predict 函数时表现异常?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/15887139/
我正在用 C++ 开发一个程序,我必须实现一个 cron。由于不同的原因,这个 cron 应该每小时和每 24 小时执行一次。我的第一个想法是创建一个独立的 pthread 并在每次 1h 内休眠。这
我需要向同一场景几何添加多个体素(立方体等于),但每个体素具有不同的纹理。 我的体素超过 500 个,导致性能出现严重错误。 这是我的代码: texture = crearTextura(voxel.
对于 MySQL 数据库,我有 2 个场景,我不确定该选择哪一个,并且对于一些表我也遇到了同样的困境。 我正在制作一个仅供成员(member)访问的网络应用程序。每个成员都有自己的交易、费用和“列表”
我想知道一个简单的事情: 当设置一个被所有 child 继承的样式时,是否建议最具体? Structure: html > body > parent_content > wrapper > p 我想
很难说出这里要问什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或夸夸其谈,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开,visit the help center . 关闭 1
这些天我正在阅读有关 JPA 的内容。我了解到可以在 JPQL 中使用 explicit 或 implicit JOIN。 显式加入 em.createQuery(“SELECT b.title, p
我有一种情况需要连接几个字符串以形成一个类的 id。基本上,我只是在列表中循环以获取对象的 ToString 值,然后将它们连接起来。 foreach (MyObject o in myList)
我正在检查我的游戏在拖尾效果下的性能会降低多少。但我注意到每秒的操作次数更多了。这怎么可能? 这是怎么回事... context.fillRect(0, 0, 500, 500); // cl
如果我可以选择使用全局变量或传递变量,哪个选项在速度和内存使用方面更好? // global variable function func(){ global $var; echo $var;
我有一个类似这样的表“tbl”:ID bigint(20) - 主键,自增字段1字段2字段3 该表有 60 万多行。 查询:SELECT * from tbl ORDER by ID LIMIT 60
谁能告诉我,我如何比较 TSP 最优和启发式算法?我已经实现了 TSP,但不知道如何比较它们。事实上,我怎样才能找到 TSP 的最优成本?有什么方法或猜测吗? 谢谢 最佳答案 用众所周知的基准实例检查
我有一个 NSTextStorage里面有长文本(比如一本书有 500 页,当前字体在设备上超过 9000 页)。我以这种方式为 textcontainer 分发此文本: let textStorag
我有一个根据邮政编码搜索项目的应用程序。 在搜索邮政编码时,我返回了来自该城市/社区的所有产品(通过解析邮政编码完成)。 我现在需要根据与原始邮政编码的距离对这些产品进行分类。 我将纬度/经度存储在数
我有许多进程(大约100到1000个进程),每个进程都必须向其他进程(例如大约10个)发送一些数据。 (通常,但不一定总是这样,如果A发送给B,B也发送给A。)每个进程都知道必须从哪个进程接收多少数据
我知道无状态组件使用起来更舒服(在特定场景下),但是既然你不能使用shouldComponentUpdate,这是否意味着组件将在每次props更改时重新渲染?我的问题是,使用带有智能 shouldC
我正在研究 Google Pagespeed 的加速页面加载时间指南列表。其中之一是缩小 CSS 和 JS 文件。 由于这些文件经常更改,我正在考虑使用 PHP 脚本根据请求(来自浏览器)即时缩小此脚
我正在尝试从下表构建 SQL 查询(示例): Example of table with name "performances" 这是带有运动表现的表格。我想从这个表中选择每个学科和一组一个或多个类别
假设我们有一个字符串 var "sA",我想检查字符串 "123"是否在 sA 的末尾。 什么更好,为什么: if(sA.length() > 2) sA.substr(sA.length()-3)
关于受这篇文章启发的可参数化查询 LINQ group by property as a parameter我获得了一个很好的参数化查询,但在性能上有一个缺点。 public static void
| 和| 之间有什么主要区别吗?和 + 从长远来看会影响代码的性能吗?或者都是 O(1)?我正在使用的代码是这样的: uint64_t dostuff(uint64_t a,uint64_t b){
我是一名优秀的程序员,十分优秀!