r - 获取属于一个因子的所有系数-6ren

r - 获取属于一个因子的所有系数

转载作者：行者123 更新时间：2023-12-02 01:27:38

25

4

我想自动确定 lm 中的哪些系数属于一个因子。所以假设我有以下模型:

d <- data.frame(a = gl(4, 2, 16), b = gl(2, 1, 16), 
                x = runif(16), y = runif(16), Y = runif(16))
l1 <- lm(Y ~ a + b + x + y, data = d)
l2 <- lm(Y ~ x + y, data = d)

那么第一个模型的系数名称如下:

names(coef(l1))
# [1] "(Intercept)" "a2"          "a3"          "a4"          "b2"         
# [6] "x"           "y"

现在理想情况下，我想要一个函数告诉我 a2、a3、a4 和 b2 是虚拟编码因子的系数。

对于不包含任何因子的模型(如 l2)，输出应为 NULL。

我查看了 str(l1)，我发现有一个插槽 xlevels(如果模型中存在因子)。我可以使用 names(l1$xlevels) 获取模型中所有因素的列表，然后在系数名称上使用 grep:

names(coef(l1))[unlist(sapply(names(l1$xlevels), function(.) grep(., names(coef(l1)))))]
# [1] "a2" "a3" "a4" "b2"

但在我看来，这似乎是一个非常肮脏的解决方法，一旦我的模型中有相似的名称，它就不会起作用:

d$a4 <- runif(16)
l3 <- update(l1, . ~ . + a4, data = d)
names(coef(l3))[unlist(sapply(names(l3$xlevels), function(.) grep(., names(coef(l3)))))]
# [1] "a2" "a3" "a4" "a4" "b2"

此外，更改默认对比度会更改模型中虚拟系数的名称，因此即使是处理系数名称的最精细的策略也可能行不通。

长话短说:我如何获得属于一个因子的所有系数的列表？

最佳答案

这里有一些方法:

1) 这假定 model.matrix 中仅包含零和一的任何列都属于一个因子(截距除外)。它适用于 l1、l2 和 l3，非常短，不依赖于名称(拦截除外)并且不需要摆弄与 lm 对象组件。它适用于主效应和交互作用，因为如果主效应为 0/1，则交互作用也将如此。注释中的 l4 是 0/1 假设不成立的示例。

m <- model.matrix(l1)
all01 <- apply(m == 0 | m == 1, 2, all)
setdiff(names(all01[all01]), "(Intercept)")
## [1] "a2" "a3" "a4" "b2"

2) 这不使用名称(拦截除外)并且适用于 l1、l2 和 l3(和评论中的 l4)。它不对模型矩阵做出任何假设，但仅适用于仅具有主要效果的模型。 (无拦截情况未经测试。)

cls <- attr(terms(l1), "dataClass")
intercept <- if ("(Intercept)" %in% names(coef(l1))) "" else "+ 0"
fn <- function(nm) names(coef(update(l1, paste(". ~", nm, intercept))))
setdiff(unlist(lapply(names(cls)[cls == "factor"], fn)), "(Intercept)")

关于r - 获取属于一个因子的所有系数，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/36143679/

25

4

0

文章推荐： subprocess - LWT 与子流程的简单交互

文章推荐： entity-framework - Npgsql 的 EntityFramework6 创建无效的更新语句

文章推荐： amazon-web-services - 如何从任何亚马逊产品网址获取 ItemID

r - (因子)数据帧列的小写
我有这种格式的data.frame: 'data.frame': 244 obs. of 1 variable: $ names: Factor w/ 244 levels "ERA","BA
Java查询求解拉伸(stretch)因子
这就是问题: write a Java Program that accepts a String and an integer stretch factor P as parameters and
r - 基于另一列的 block 因子
该示例显示了不同工厂的产量测量值，第一列表示工厂最后一列是生产量。 factory % mutate(factory=fct_lump(factory,2)) factory produc
r - 分类变量(因子)与虚拟变量的区别
我正在使用分类变量运行回归并遇到 this question .在这里，用户想要为每个虚拟对象添加一列。这让我很困惑，因为我虽然列有很长的数据，包括使用 as.factor() 存储的所有虚拟数据。相
r - 修改 R 因子？
假设在 R 中有一个 Data.Frame 对象，其中所有字符列都已转换为因子。然后我需要“修改”与数据帧中某一行相关联的值——但将其编码为一个因子。我首先需要提取一行，所以这就是我正在做的。这是一个
r - 计算一个数字(因子)在每组中出现的次数
利用下面的可重现数据， dat head(dat) Bin Number 1 1 3 2 1 5 3 1 4 4 1 5 5 1
R:删除具有预定出现频率和自动更新因子水平的变量(因子)的行
我有一组包含多个变量的数据。其中一个变量 - 阶乘包含组的名称 - A、B、C 等。其余变量是数字。 > data1 Group Value 1 A 23 2 A
r - 虚拟变量到 R 中的单个分类变量(因子)
我有一组编码为二项式的变量。 Pre VALUE_1 VALUE_2 VALUE_3 VALUE_4 VALUE_5 VALUE_6 VALUE_7 VALUE_8 1 1 0
r - 将各种虚拟/逻辑变量从 R 中的名称转换为单个分类变量/因子
我的问题与 this one 非常相似和 this other one ，但我的数据集有点不同，我似乎无法使这些解决方案起作用。如果我误解了什么并且这个问题是多余的，请原谅。我有一个这样的数据集:
r - ggplot2 因子 x 变量打破 geom_area
我一直在尝试生成一个带有离散 x 变量的堆积面积图(因为我想显示财政年度，即“2013/14”，而不是日历年)。但是，将 x 轴变量转换为一个因子会阻止在最终图表中呈现 geom。有解决办法吗？ l
java - 具有 1.0 maxLoad 因子、时间复杂度的哈希表
只是一个简单的问题来确认我的想法，使用负载因子 1.0 的哈希表的复杂性将是二次时间，用以下符号 O(n^2) 表示。这是因为必须不断调整大小并一遍又一遍地插入。如果我错了，请纠正我。谢谢最佳
r - 因子 MSZoning 具有新级别 NA(数据中有新因子，但线性回归模型中没有)
我正在尝试使用 kaggle 的一些数据集进行房价预测。这是我的代码 library(ggplot2) dataset=read.csv('train(1).csv') dataset_test=r
javascript - 如何构建操纵 DOM 的 Angular 因子/服务
我正在用 Angular 构建一个类似咆哮的 UI。我想将其公开为工厂(或服务)，以使其在我的 Controller 中可用。调用 Growl.add 将导致 DOM 发生变化，所以看起来我应该有一个
python - 将 Pandas Dataframe 列转换为 R 因子
我正在尝试将 pandas 数据框的一列转换为因数，因为我试图在 R 中调用的函数需要因数。 pandas2ri.activate() #second column of labels has
R plotly x 轴字符/因子(组合数字和 -)。绘图仅显示仅包含数字的轴。漏洞？
我正在尝试使用 plotly 绘制一个以字符串(组合数)作为 x 轴的条形图。 (“1”、“2”、“3”、“4 - 5”、“6 - 8”、“9 - 13”、“14 - 21”、“22 - 34”、“3
因子()和 NAs 的 R caret/rfe 变量选择
我有一个包含 NA 的数据集。此外，它还有一些列需要factors()。我正在使用 caret 包中的 rfe() 函数来选择变量。似乎 rfe() 中的 functions= 参数使用 lmF
r - 如何防止 write.csv 将 POSIXct、日期和时间类更改回字符/因子？
我有一个 .csv 文件，其中每个字段用于日期时间、日期和时间。最初它们都是字符字段，我已经相应地转换了它们。在我的代码结束时，如果我这样做: str(data) 我会得到 datetime: P
r - R 中的 NaiveBayes 无法预测 - 因子 (0) 级别 :
我有一个如下所示的数据集: data.flu data.flu chills runnyNose headache fever flu 1 1 0 M
c++ - QMainWindow::splitDockWidget 的 QDockWidget 拉伸(stretch)因子？
我正在使用 QMainWindow 在 C++ 中手动布置 Qt 应用程序。我希望在屏幕底部有两个并排停靠的小部件，但我希望它们具有不成比例的宽度。目前，我只能让它们具有相同的宽度。有没有办法设置拉伸
java - 使用 Java 计算 MOS、抖动和 R 因子
我需要通过在两个主机(2 个 Java 进程)之间发送合成调用来计算 VOIP 质量。我应该找出 MOS、抖动和 R 因子(VOIP 质量指标)。根据目前的研究，我发现我应该在两台主机之间发送 RTP

首页

博学

6Ren·AI

商城

r - 获取属于一个因子的所有系数