gpt4 book ai didi

按组保留行,直到在列中首次出现值为止。没有值(value)的团体

转载 作者:行者123 更新时间:2023-12-04 10:36:37 25 4
gpt4 key购买 nike

我有一个像这样的数据框:

> df
id type
1 1 a
2 1 a
3 1 b
4 1 a
5 1 b
6 2 a
7 2 a
8 2 b
9 3 a
10 3 a

我想保留每个组(id)的所有行,直到类型列中首次出现值'b'为止。对于没有类型“b”的组,我想保留其所有行。

产生的数据框应如下所示:
> dfnew
id type
1 1 a
2 1 a
3 1 b
4 2 a
5 2 a
6 2 b
7 3 a
8 3 a

我尝试了以下代码,但是它保留了第一次出现的“b”之后具有值“a”的其他行,并且仅排除了另外出现的“b”,这不是我想要的。请看下面的第4行。我想摆脱它。
> df %>% group_by(id) %>% filter(cumsum(type == 'b') <= 1)
Source: local data frame [7 x 2]
Groups: id

id type
1 1 a
2 1 a
3 1 b
4 1 a
5 2 a
6 2 a
7 2 b
8 3 a
9 3 a

最佳答案

您可以将matchwhichslice或(如@Richard所述)which.max结合使用

library(dplyr)
df %>%
group_by(id) %>%
slice(if(any(type == "b")) 1:which.max(type == "b") else row_number())
# Source: local data table [8 x 2]
# Groups: id
#
# id type
# 1 1 a
# 2 1 a
# 3 1 b
# 4 2 a
# 5 2 a
# 6 2 b
# 7 3 a
# 8 3 a

或者您可以尝试使用 data.table
library(data.table)
setDT(df)[, if(any(type == "b")) .SD[1:which.max(type == "b")] else .SD, by = id]
# id type
# 1: 1 a
# 2: 1 a
# 3: 1 b
# 4: 2 a
# 5: 2 a
# 6: 2 b
# 7: 3 a
# 8: 3 a

关于按组保留行,直到在列中首次出现值为止。没有值(value)的团体,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/31734831/

25 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com