r - 使用 dplyr 到 group_by 并仅使用 if(没有 else)语句有条件地变异-6ren

r - 使用 dplyr 到 group_by 并仅使用 if(没有 else)语句有条件地变异

转载作者：行者123 更新时间：2023-12-02 00:55:47

25

4

我有一个数据框，我需要按列条目的组合对其进行分组，以便仅使用 if 语句(没有 else 条件)有条件地改变几列。

更具体地说，如果某个组的列值超过预定义的阈值，我想对它们求和，否则这些值应保持不变。

我试过用 if_else 来做这件事和 case_when但是这些函数需要“false”参数( if_else )或默认设置与 NA 不匹配的值( case_when ):

iris_mutated <- iris %>%
  dplyr::group_by(Species) %>%
  dplyr::mutate(Sepal.Length=if_else(sum(Sepal.Length)>250, sum(Sepal.Length)),
                Sepal.Width=if_else(sum(Sepal.Width)>170, sum(Sepal.Width)),
                Petal.Length=if_else(sum(Petal.Length)>70, sum(Petal.Length)),
                Petal.Width=if_else(sum(Petal.Width)>15, sum(Petal.Width)))

iris_mutated <- iris %>%
  dplyr::group_by(Species) %>%
  dplyr::mutate(Sepal.Length=case_when(sum(Sepal.Length)>250 ~ sum(Sepal.Length)),
                Sepal.Width=case_when(sum(Sepal.Width)>170 ~ sum(Sepal.Width)),
                Petal.Length=case_when(sum(Petal.Length)>70 ~ sum(Petal.Length)),
                Petal.Width=case_when(sum(Petal.Width)>15 ~ sum(Petal.Width)))

任何想法如何做到这一点？

编辑:

这是预期输出的示例。
所有物种分组条目的花瓣宽度总和为 setosa 的 12.3、virginica 的 101.3 和 versicolor 的 66.3。如果我要求这个总和应该至少为 15 来求和的值(否则应该保留原始值)，那么我期望以下输出(仅显示列“Petal.Width”和“Species”):

Petal.Width    Species
1           0.2     setosa
2           0.2     setosa
3           0.2     setosa
4           0.2     setosa
5           0.2     setosa
6           0.4     setosa
7           0.3     setosa
8           0.2     setosa
9           0.2     setosa
10          0.1     setosa
#...#
50          0.2     setosa
51          66.3 versicolor
52          66.3 versicolor
53          66.3 versicolor
#...#
100         66.3 versicolor
101         101.3  virginica
102         101.3  virginica
103         101.3  virginica
#...#
150         101.3  virginica

最佳答案

我想你是在追求这个吗？使用约翰尼的方法。在总和不大于截止值的情况下，当您使用原始值作为 case_when 的一部分时，您不应该遇到错误...

iris_mutated <- iris %>% 
  group_by(Species) %>% 
  mutate(Sepal.Length = case_when(sum(Sepal.Length) > 250 ~ sum(Sepal.Length),
                                   T ~ Sepal.Length),
         Sepal.Width = case_when(sum(Sepal.Width) > 170 ~ sum(Sepal.Width),
                                   T ~ Sepal.Width),
         Petal.Length = case_when(sum(Petal.Length) > 70 ~ sum(Petal.Length),
                                   T ~ Petal.Length),
         Petal.Width = case_when(sum(Petal.Width) > 15 ~ sum(Petal.Width),
                                   T ~ Petal.Width))

关于r - 使用 dplyr 到 group_by 并仅使用 if(没有 else)语句有条件地变异，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/54404043/

25

4

0

文章推荐： c - C 中的整数和 float 除法

文章推荐： wpf - 棱镜区域 UpdateRegionsException

文章推荐： r - 如何根据多个条件创建列？

文章推荐： r - 在函数内的 dplyr 中的列中存储和调用变量

r - 基于配对数据的额外列(变异)
我有一个包含配对数据的数据集(同一家庭的成员)。身份证是个人标识符和户号是合作伙伴的标识符(反之亦然)。我需要的是为每个添加一个额外的列(职业)。 id 他\她的伴侣。我的数据看起来像这样
r - 在多个变量的逻辑条件下使用变异创建新变量 - 变异？
mutate 能否根据跨变量应用的逻辑条件创建新变量？更具体地说，请考虑以下数据。 set.seed(1234) val = 1) head(dat) a b c d anyABCD 1 0 0
R - 变异 if + 动态创建列名
我的 df 看起来像这样: df % mutate_at(vars(starts_with("paid")), list(prc = ~. / expenses)) # expenses mon
R - 变异 if + 动态创建列名
我的 df 看起来像这样: df % mutate_at(vars(starts_with("paid")), list(prc = ~. / expenses)) # expenses mon
Python 列表值被更改/变异
我在这里为项目 Euler 问题 31 运行了这个简单的代码。不需要 Euler Q；我只想知道，为什么我的列表值会发生变化，即这是打印 [2.0,2.0,2.0,2.0,2.0] 的许多列表的列表
r - 变异 - NA 处理
我使用了排列和变异组合来根据分组进行添加。例如，我使用了以下内容: master_df % group_by(asof_dt) %>% mutate(tot_flag = sum(ls_fla
r - 变异、交叉和 case_when
我在让 mutate、cross 和 case_when 正常运行时遇到了一些麻烦，我在这里重新创建了一个简单版本的问题: a 1 1 2 3 2 2
r - dplyr:使用滚动时间窗口对数据进行分组和汇总/变异
我有代表用户某种交易类型的不规则时间序列数据。每行数据都带有时间戳，表示当时的事务。由于数据的不规则性质，某些用户一天可能有100行，而其他用户一天可能有0或1个事务。数据可能看起来像这样: dat
javascript - 重新分配、变异、引用类型和值类型
您如何恰本地解释为什么这两个示例不同？ // Reassignment let a = 1; let b = a; a = 2; console.log(b); // → 1 // Mutation
以列表作为参数变量的 Golang 变异 (GRAPHQL)
基本上我想做的是发送一个字符串列表 ex: ["aa","bb","vv"] 到 graphql Mutation 字段中，目前这是我的 Mutation Schema "listTest": &gr
r - dplyr:组均值居中(变异+总结)
使用 dplyr 进行组均值居中的有效/首选方法是什么，即获取组中的每个元素(mutate)并对其执行操作和汇总统计信息(该组的总结)。以下是使用基本 R 以 mtcars 为中心的组均值: do.c
r - dplyr 中的 substr %>% 变异
pcd % arrange(tripNo, procDate, delay) %>% group_by(tripNo) %>% mutate(delayErr = (row_number(
graphql - 紧跟查询类型后的字符串的意义(查询/变异)GraphQL
我想知道查询类型后面的字符串有什么意义，在这种情况下是“ProvisionQueues”，似乎从字符串中删除它不会影响任何东西——它只是用于日志记录还是什么。元数据？ mutation Provisi
graphql - Apollo GraphQL 变异(对象参数)
所以，我正在尝试设计我的 Apollo 服务器。我想用一个对象作为参数来创建一个突变。这是我的架构的一个片段，它以某种方式导致了问题: 我认为它在语法上是正确的，但我遇到了这个错误: {"error
sql - 变异，触发器/函数可能看不到它-触发器执行期间的错误
CREATE OR REPLACE TRIGGER UPDATE_TEST_280510 AFTER insert on TEST_TRNCOMPVISIT declare V_TRNCOMPNO N
javascript - Apollo:数据/变异 Prop 未传递给组件
我有以下带有查询和突变的组件，但我的组件没有收到数据和突变 prop。我的代码是不是做错了什么或遗漏了什么？虽然查询确实得到执行，但它没有传递下去。 this.props.mutate 和 this
encryption - Golang AES CFB - 变异 IV
我用 Go 编写了一个客户端应用程序，它需要与服务器端的 C 程序进行交互。客户端执行 AES CFB 加密，服务器解密。不幸的是，服务器端存在重用初始化向量的错误。它尝试根据以下条件进行 3 次解密
express - 如何从 Express 服务器后端调用 GraphQL 查询/变异？
我的前端是 localhost:3000 ，我的 GraphQL 服务器是 localhost:3333 . 我已经使用 react-apollo 在 JSX 领域中查询/变异，但还没有从 Expre
kubernetes - 如何使用变异 webhook 变异 kubernetes 资源 'bindings'
我试图改变通常情况下来自 kube-scheduler 的资源“绑定(bind)”。以下是我的“ValidatingWebhookConfiguration”yaml: apiVersion: ad
kubernetes - kubernetes 变异 webhook 服务器的 API 端点
如所述here , 这是一个 reference implementation用于 kubernetes e2e 测试的 webhook 服务器。在 main 函数中，定义了一些端点来处理不同的突变请

首页

博学

6Ren·AI

商城

r - 使用 dplyr 到 group_by 并仅使用 if(没有 else)语句有条件地变异