r - 由强制引起的 NA _ 平均值和 SD

r - 由强制引起的 NA _ 平均值和 SD _ 百分比

转载作者：行者123 更新时间：2023-12-04 10:47:39

33

4

我正在尝试为“Variable1”和“Variable2”列中“Group”(0, 1 2) 列下的 3 个组获得一些平均值和 SD。

数据集对不起，我需要像这样提供它，但我不知道如何粘贴它

> dput(test)

structure(list(Subject_ID = structure(1:163, .Label = c("1", 
"2", "3", "4", "5", "6", "7", "8", "9", "10", "11", "12", "13", 
"14", "15", "16", "17", "18", "19", "20", "21", "22", "23", "24", 
"25", "26", "27", "28", "29", "30", "31", "32", "33", "34", "35", 
"36", "37", "38", "39", "40", "41", "42", "43", "44", "45", "46", 
"47", "48", "49", "50", "51", "52", "53", "54", "55", "56", "57", 
"58", "59", "60", "61", "62", "63", "64", "65", "66", "67", "68", 
"69", "70", "71", "72", "73", "74", "75", "76", "77", "78", "79", 
"80", "81", "82", "83", "84", "85", "86", "87", "88", "89", "90", 
"91", "92", "93", "94", "95", "96", "97", "98", "99", "100", 
"101", "102", "103", "104", "105", "106", "107", "108", "109", 
"110", "111", "112", "113", "114", "115", "116", "117", "118", 
"119", "120", "121", "122", "123", "124", "125", "126", "127", 
"128", "129", "130", "131", "132", "133", "134", "135", "136", 
"137", "138", "139", "140", "141", "142", "143", "144", "145", 
"146", "147", "148", "149", "150", "151", "152", "153", "154", 
"155", "156", "157", "158", "159", "160", "161", "162", "163"
), class = "factor"), Variable1 = c(270, 206, 291, 81, 254, 253, 
224, 324, 139, 164, 113, 140, 158, 202, 324, 99, 201, 222, 244, 
197, 91, 200, 366, 203, 151, 202, 237, 194, 72, 227, 134, 270, 
281, 260, 276, 110, 76, 364, 296, 222, 300, 203, 100, 295, 219, 
235, 277, 202, 132, 243, 222, 317, 153, 232, 266, 254, 224, 267, 
83, 302, 230, 217, 474, 235, NA, 244, 287, 261, 261, 222, 218, 
328, 302, 282, 105, 213, 254, 323, 259, 297, 94, 429, 297, 253, 
207, 234, 171, 225, 310, 216, 172, 392, 240, 306, 167, 40, 230, 
405, 278, 140, 385, 207, 96, 301, 130, 137, 260, 178, 229, 174, 
157, 116, 44, 244, 237, 220, 240, 223, 317, 232, 132, 168, 289, 
55, 267, 317, 251, 196, 160, 149, 308, 281, 287, 193, 161, 279, 
270, 273, 397, 138, 272, 208, 231, 291, 245, 351, 238, 100, 352, 
66, 224, 273, 262, 259, 217, 334, 264, 293, 412, 157, 164, 263, 
199), Variable2 = c(NA, 6.1, 4.3, 18.6, 6.4, 6.7, 6.9, 9.2, 4.2, 
6.9, 14.3, 21.6, 2.9, 11.9, 6.1, 12.7, 6, 5.2, 4.5, 6.1, 9.6, 
3.5, 6.6, 5.4, 3.9, 3.1, 4.3, 5.1, 69.1, 4.1, 22.3, 6.3, 8, 10.2, 
6.4, 11.2, 13.8, 6.5, 6.2, 4.8, 6.5, 5.5, 29.9, 10.9, 10.7, 4.7, 
5.3, 25.4, 11.8, 10, 9, 8, 6.8, 6.6, 6, 7.7, 6.5, 6.4, 18.2, 
11.9, 11.8, 3.9, 18.8, 7.6, 5.1, 7.7, 5.3, 5.7, 5.3, 6.3, 2.7, 
4.5, 6.3, 7.5, 11.9, 6.8, 3.2, 12, 7.8, 4, 48, 3.9, 7.9, 15.4, 
6.8, 4.5, 3.7, 6.9, 3.8, 10.1, 3.7, 5.1, 6, 5.3, 7.2, 8.6, 7.6, 
7.1, 5.9, 5.1, 8.9, 17.3, 27.7, 6.2, 5.8, 26.3, 7.9, 13.5, 9.7, 
11.7, 6.8, 18.4, 27.7, 26.3, 12, 46.5, 4.7, 11.4, 5.4, 3.1, 23.4, 
12, 16.6, 27.7, 3.7, 6.1, 6.8, 8.1, 20.4, 14.3, 6, 6.9, 8.4, 
8.8, 16.9, 6.1, 7.3, 3.5, 10.8, 16, 5.7, 9.5, 10.7, 8.5, 7.7, 
6.9, 8.7, 22.4, 8.2, 16.7, 7.6, 6.1, 7.1, 11.9, 5.3, 5.4, 8.3, 
6.8, 12.2, 11.5, 6.9, 5.9, 4.5), Group = structure(c(1L, 1L, 
1L, 1L, 1L, 1L, 1L, 1L, 1L, 1L, 2L, 1L, 1L, 1L, 1L, 1L, 1L, 2L, 
2L, 1L, 1L, 1L, 2L, 2L, 2L, 1L, 2L, 2L, 3L, 1L, 2L, 2L, 2L, 3L, 
3L, 3L, 1L, 3L, 3L, 2L, 3L, 1L, 2L, 3L, 1L, 1L, 2L, 2L, 3L, 3L, 
3L, 3L, 3L, 3L, 3L, 3L, 1L, 3L, 3L, 3L, 2L, 1L, 3L, 3L, 2L, 2L, 
2L, 2L, 3L, 3L, 2L, 2L, 2L, 2L, 1L, 2L, 1L, 1L, 1L, 1L, 2L, 3L, 
2L, 3L, 2L, 1L, 2L, 2L, 1L, 3L, 1L, 3L, 3L, 3L, 2L, 1L, 2L, 2L, 
1L, 3L, 3L, 3L, 2L, 1L, 1L, 2L, 2L, 3L, 3L, 2L, 3L, 1L, 1L, 2L, 
1L, 2L, 2L, 1L, 1L, 1L, 3L, 2L, 3L, 2L, 2L, 3L, 2L, 2L, 2L, 2L, 
3L, 1L, 3L, 1L, 2L, 3L, 3L, 2L, 2L, 1L, 2L, 3L, 2L, 1L, 3L, 3L, 
2L, 1L, 1L, 1L, 3L, 3L, 1L, 3L, 3L, 1L, 3L, 2L, 3L, 1L, 1L, 2L, 
3L), .Label = c("0", "1", "2"), class = "factor")), row.names = c(NA, 
-163L), class = "data.frame")

代码

我已经将变量 1 和 2 转换为数字:

data$Variable1 <- as.numeric(as.character(data$Variable1))
data$Variable2 <- as.numeric(as.character(data$Variable2))

并要求提供手段和标准差为:

meanSD<-ddply(data, .(Group),summarise,
          meanV1= mean(Variable1),na.rm = TRUE,
          SD_V1=sd(Variable1),na.rm = TRUE,
          meanV2= mean(Variable2),na.rm = TRUE,
          SD_V2=sd(Variable2),na.rm = TRUE)

输出

我得到的表:

对于变量 1:

对于变量 2:

Error in var(if (is.vector(x) || is.factor(x)) x else as.double(x), na.rm = na.rm) : 
 Calling var(x) on a factor x is defunct.

Use something like 'all(duplicated(x)[-1L])' to test for a constant vector.In addition: Warning message:In mean.default(Variable2) : argument is not numeric or logical: returning NA

在之前的分析中，我遇到了一个错误: NAs induced by coercion.
问题
嗯，问题很明显:当我的数据上有数字时，为什么我会得到 NA？

我能够毫无问题地在 Excel 中进行计算。但我担心我的数据实际上包含问题。我需要这方面的帮助。

万提前感谢您的帮助!

莉莉

最佳答案

移动 na.rm=T括号内:

library(plyr)
meanSD<-ddply(data, .(Group),summarise,
              meanV1= mean(Variable1,na.rm = TRUE),
              SD_V1=sd(Variable1,na.rm = TRUE),
              meanV2= mean(Variable2,na.rm = TRUE),
              SD_V2=sd(Variable2,na.rm = TRUE))

> meanSD
  Group   meanV1    SD_V1    meanV2     SD_V2
1     0 207.6964 80.41798  8.650909  5.415816
2     1 224.4815 72.39221 11.327273 10.108128
3     2 255.8077 83.28431 10.161538  9.297399

和 dplyr替代方案(请注意 plyr 已正式退休):

library(dplyr)
data %>%
  group_by(Group) %>%
  summarise_if(
    is.numeric,
    list(mean = mean, sd = sd),
    na.rm = TRUE
  )

关于r - 由强制引起的 NA _ 平均值和 SD _ 百分比，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/59629551/

33

4

0

文章推荐： c# - 多个实体到同一个 DbSet

文章推荐： __groovy 中的 Java 函数执行但结果未分配给变量

文章推荐： java - 为什么我们在 selenium webdriver 中需要 Guava ？

.htaccess - 强制 https，强制到子文件夹，强制 www，不要破坏站点
我一直很难编辑我的 .htaccess 文件来一起做这三件事。我已经能够分别获得每个部分，但我只是不明白逻辑流程如何使它们全部工作。这是我能够使用 bluehost support 上的演示进行整合
vba - 强制"is"以保存并另存为无宏工作簿
我制作的宏将模板工作簿保存为两个单独的文件。每个测试保存一个(位置 1、2、3 或 4)，然后在另一个宏中使用每个测试的数据。第二个是保留用于备份的原始数据文件。现在的问题是每次我在每个位置运行测试并
types - 包括模块、强制
我正在写一篇关于如何使用 OCaml 的模块系统而不是 Java 的 OO 系统(一个有趣的视角)的博客文章。我遇到了一些我不理解的关于强制的事情。下面是一个基本模块和两个包含它的模块: module
c - 强制 if 语句只执行一次
我有一段将被执行多次(5,000+)的代码，以及一个仅在第一次为真的 if 语句。我曾想过使用“FIRST”变量并每次都进行比较，但每次都检查它似乎是一种浪费，即使我知道它不需要。 bool FIRS
强制 P4CONFIG 未设置？
首先，我是 Perforce 的新手，我主要通过其文档进行学习。因此，我们即将从 CVS 迁移到 Perforce，我最近学到了一个避免更改每个工作区的 P4CLIENT 的好方法，即在工作区根目录
java - 强制 FileNotFoundException
我正在为一段代码编写测试，其中包含我试图涵盖的 IOException 捕获。 try/catch 看起来像这样: try { oos = new ObjectOutputStream(new
javascript - 强制 $.each() 循环等待动画完成后再继续
我正在尝试在新闻项目滚动之间添加延迟。我知道 $.each() 通过不等待动画完成来完成其工作，但我想知道如何制作它，以便一次向上滚动一个项目并等到最后一个动画完成后再继续在循环中。 $(functi
c# - 强制/要求方法的排序列表参数
假设已经编写了一个方法，需要一个排序列表作为其输入之一。当然这将在代码中进行注释和记录，param 将被命名为“sortedList”，但如果有人忘记，则会出现错误。有没有办法强制输入必须排序？我正
Apache 强制 SSL
我正在尝试将传入请求重定向到 https://www.domain.com/和所有 https://www.domain.com/ {所有页面}并且没有什么麻烦。我试过的方法: 添加此行:Redire
python - 强制 raw_input
我将如何实现以下内容: title_selection = raw_input("Please type in the number of your title and press Enter.\n%
javascript - 在浏览器中自动完成 ="off"强制
我有一个登录表单，我需要强制关闭自动完成功能。我试过了 jquery: $('#login').attr("autocomplete", "off"); HTML: Javascript:docume
Git 强制 merge
我想知道我应该怎么做才能强制从 dev 分支 merge 到我的 master 分支？使用“git merge dev”会导致很多冲突。但是，我不想单独处理它们。相反，我只是想使用我的 dev 分支中
c# - 强制 Nuget 包使用特定版本的子依赖项？
当安装 Hl7.Fhir.DSTU2 和 Hl7.Fhir.R4 这两个 Nuget 包时，我们得到如下信息: DSTU2 包似乎在使用 Hl7.Fhir.Support.Poco 版本 3.4.0
reactjs - 强制 react 功能组件触发重新渲染
我正在尝试让一个功能组件在 testFn 执行时强制重新渲染。我想使用状态来做到这一点(如果有更好的方法请说出来)，这似乎成功地强制重新渲染但只有两次，然后什么都没有。我构建了一个简单的演示来模拟这
g++ - 强制 g++ 为未使用的函数生成代码
默认情况下，g++ 似乎会省略未使用的类内定义方法的代码。示例 from my previous question : struct Foo { void bar() {} void baz(
html - 强制 div 高度以适应透视内容
我正在尝试使用 here 中介绍的技术使我的网站背景以比内容慢的速度滚动。我不希望背景固定，只希望更慢。这是 HTML 的样子: .parallax { perspective: 1px;
dart - 强制 ListView 缩小以包含子项
我能找到的最相似的问题是 'how to create a row of scrollable text boxes or widgets in flutter inside a ListView?'
javascript - 强制(修复)导入完全在一行中
我有以下 eslint 配置: "object-curly-newline": ["error", { "ImportDeclaration": "never",
tinymce - 强制 TinyMCE 去除数据属性
我正在使用 TinyMCE 插件并将 valid_elements 选项设置为: "a[href|target:_blank],strong/b,em/i,br,p,ul,ol,li" 即使没有列出数
强制 : wanted to Multiline description
您好，我想使用以下命令放置多行描述 p4 --field Description="MY CLN Header \\n my CLN complete description in two -thre

首页

博学

6Ren·AI

商城

r - 由强制引起的 NA _ 平均值和 SD _ 百分比