r - 变异多个变量以创建多个新变量-6ren

r - 变异多个变量以创建多个新变量

转载作者：行者123 更新时间：2023-12-04 16:57:56

25

4

假设我有一个 tibble我需要获取多个变量并将它们变异为新的多个新变量。

例如，这是一个简单的 tibble:

tb <- tribble(
  ~x, ~y1, ~y2, ~y3, ~z,
  1,2,4,6,2,
  2,1,2,3,3,
  3,6,4,2,1
)

我想从名称以“y”开头的每个变量中减去变量 z，并将结果变异为 tb 的新变量。另外，假设我不知道我有多少“y”变量。我希望解决方案能很好地适应 tidyverse/ dplyr工作流程。

本质上，我不明白如何将多个变量变异为多个新变量。我不确定您是否可以使用 mutate在这种情况下？我试过 mutate_if ，但我认为我没有正确使用它(并且出现错误):

tb %>% mutate_if(starts_with("y"), funs(.-z))

#Error: No tidyselect variables were registered

提前致谢!

最佳答案

因为是对列名进行操作，所以需要使用mutate_at而不是 mutate_if它使用列中的值

tb %>% mutate_at(vars(starts_with("y")), funs(. - z))
#> # A tibble: 3 x 5
#>       x    y1    y2    y3     z
#>   <dbl> <dbl> <dbl> <dbl> <dbl>
#> 1     1     0     2     4     2
#> 2     2    -2    -1     0     3
#> 3     3     5     3     1     1

要创建新列，而不是覆盖现有列，我们可以为 funs 命名。

# add suffix
tb %>% mutate_at(vars(starts_with("y")), funs(mod = . - z))
#> # A tibble: 3 x 8
#>       x    y1    y2    y3     z y1_mod y2_mod y3_mod
#>   <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2      0      2      4
#> 2     2     1     2     3     3     -2     -1      0
#> 3     3     6     4     2     1      5      3      1

# remove suffix, add prefix
tb %>%
  mutate_at(vars(starts_with("y")),  funs(mod = . - z)) %>%
  rename_at(vars(ends_with("_mod")), funs(paste("mod", gsub("_mod", "", .), sep = "_")))
#> # A tibble: 3 x 8
#>       x    y1    y2    y3     z mod_y1 mod_y2 mod_y3
#>   <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2      0      2      4
#> 2     2     1     2     3     3     -2     -1      0
#> 3     3     6     4     2     1      5      3      1

编辑 : 在 dplyr 0.8.0或更高版本， funs()将被弃用( source1 & source2 )，需要使用 list()反而

tb %>% mutate_at(vars(starts_with("y")), list(~ . - z))
#> # A tibble: 3 x 5
#>       x    y1    y2    y3     z
#>   <dbl> <dbl> <dbl> <dbl> <dbl>
#> 1     1     0     2     4     2
#> 2     2    -2    -1     0     3
#> 3     3     5     3     1     1

tb %>% mutate_at(vars(starts_with("y")), list(mod = ~ . - z))
#> # A tibble: 3 x 8
#>       x    y1    y2    y3     z y1_mod y2_mod y3_mod
#>   <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2      0      2      4
#> 2     2     1     2     3     3     -2     -1      0
#> 3     3     6     4     2     1      5      3      1

tb %>%
  mutate_at(vars(starts_with("y")),  list(mod = ~ . - z)) %>%
  rename_at(vars(ends_with("_mod")), list(~ paste("mod", gsub("_mod", "", .), sep = "_")))
#> # A tibble: 3 x 8
#>       x    y1    y2    y3     z mod_y1 mod_y2 mod_y3
#>   <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2      0      2      4
#> 2     2     1     2     3     3     -2     -1      0
#> 3     3     6     4     2     1      5      3      1

编辑 2 : dplyr 1.0.0+有 across() 进一步简化此任务的功能

Basic usage

across() has two primary arguments:

The first argument, .cols, selects the columns you want to operate on.It uses tidy selection (like select()) so you can pick variables byposition, name, and type.

The second argument, .fns, is a function or list of functions to apply toeach column. This can also be a purrr style formula (or list of formulas)like ~ .x / 2. (This argument is optional, and you can omit it if you just wantto get the underlying data; you'll see that technique used invignette("rowwise").)

# Control how the names are created with the `.names` argument which 
# takes a [glue](http://glue.tidyverse.org/) spec:
tb %>% 
  mutate(
    across(starts_with("y"), ~ .x - z, .names = "mod_{col}")
  )
#> # A tibble: 3 x 8
#>       x    y1    y2    y3     z mod_y1 mod_y2 mod_y3
#>   <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2      0      2      4
#> 2     2     1     2     3     3     -2     -1      0
#> 3     3     6     4     2     1      5      3      1

tb %>% 
  mutate(
    across(num_range(prefix = "y", range = 1:3), ~ .x - z, .names = "mod_{col}")
  )
#> # A tibble: 3 x 8
#>       x    y1    y2    y3     z mod_y1 mod_y2 mod_y3
#>   <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2      0      2      4
#> 2     2     1     2     3     3     -2     -1      0
#> 3     3     6     4     2     1      5      3      1

### Multiple functions
tb %>% 
  mutate(
    across(c(matches("x"), contains("z")), ~ max(.x, na.rm = TRUE), .names = "max_{col}"),
    across(c(y1:y3), ~ .x - z, .names = "mod_{col}")
  )
#> # A tibble: 3 x 10
#>       x    y1    y2    y3     z max_x max_z mod_y1 mod_y2 mod_y3
#>   <dbl> <dbl> <dbl> <dbl> <dbl> <dbl> <dbl>  <dbl>  <dbl>  <dbl>
#> 1     1     2     4     6     2     3     3      0      2      4
#> 2     2     1     2     3     3     3     3     -2     -1      0
#> 3     3     6     4     2     1     3     3      5      3      1

创建于 2018-10-29 由 reprex package (v0.2.1)

关于r - 变异多个变量以创建多个新变量，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/48898121/

25

4

0

文章推荐： WCF : namespace of datamember different than parent

文章推荐： Xml 命名空间 - Coldfusion

文章推荐： scala - 动态构建 Spark SQL 查询

java - 新 PrintWriter(新 BufferedWriter(新 PrintWriter(s.getOutputStream，真)))
我想知道有没有可能做 new PrintWriter(new BufferedWriter(new PrintWriter(s.getOutputStream, true))) 在 Java 中，s
java - 新 ConcurrentHashMap 新 ConcurrentHashMap
我正在尝试使用 ConcurrentHashMap 初始化 ConcurrentHashMap private final ConcurrentHashMap > myMulitiConcurrent
.net - 新{object}与{object} =新{object}
我只是想知道两个不同的新对象初始化器之间是否有任何区别，还是仅仅是语法糖。因此: Dim _StreamReader as New Streamreader(mystream) 与以下内容不同: D
c++ - A* pA = 新 A 之间的差异；和 A* pA = 新 A();
在 C++ 中，以下两种动态对象创建之间的确切区别是什么: A* pA = new A; A* pA = new A(); 我做了一些测试，但似乎在这两种情况下，都调用了默认构造函数，并且只调用了它。
vb.net - xslt.Load(新 XmlTextReader(新 StringReader(xslt))) "xslt compile error"
我已经阅读了其他帖子，但它们没有解决我的问题。环境为VB 2008(2.0 Framework)下面的代码在 xslt.Load 行导致 XSLT 编译错误下面是错误的输出。我将 XSLT 作为字符串
javascript - 警报(新 boolean 值(假))与console.log(新 boolean 值(假))
我想知道为什么alert(new Boolean(false))打印 false 而不是打印对象，因为 new Boolean 应该返回对象。如果我使用 console.log(new Boolean
Python装饰器用法实例总结(新)
本文实例讲述了Python装饰器用法。分享给大家供大家参考，具体如下：写装饰器装饰器只不过是一种函数，接收被装饰的可调用对象作为它的唯一参数，然后返回一个可调用对象（就像前面的简单例子）注
r - 在knitr中指定多个同时输出格式(新)
我可以编写 YAML header 来使用 knit 为 R Markdown 文件生成多种输出格式吗？我无法重现 the original question with this title 的答案中
r - 在knitr中指定多种同时输出格式(新)
我可以编写一个YAML标头以使用knitr为R Markdown文件生成多种输出格式吗？我无法重现the original question with this title答案中描述的功能。这个降价
r - 绘制脉冲响应函数(新)
我正在使用vars package可视化脉冲响应。示例: library(vars) Canada % names ir % `$`(irf) %>% `[[`(variables[e])) %>%
c# - 如何对泛型约束类使用方法隐藏(新)
我有一个容器类，它有一个通用参数，该参数被限制到某个基类。提供给泛型的类型是基类约束的子类。子类使用方法隐藏(新)来更改基类方法的行为(不，我不能将其设为虚拟，因为它不是我的代码)。我的问题是"new
java - 找不到符号 = 新
Java 在提示! cannot find symbol symbol : constructor Bar() location: class Bar JPanel panel =
新 Activity 开始后Android跟踪触摸事件
在我的应用程序中，一个新的 Activity 从触摸按钮(而不是点击)开始，而且我没有抬起手指并希望在新的 Activity 中跟踪触摸的 Action 。第二个 Activity 中的触摸监听器不响
ios - 新/相关应用程序的应用程序内公告？
已关闭。此问题旨在寻求有关书籍、工具、软件库等的建议。不符合Stack Overflow guidelines .它目前不接受答案。我们不允许提问寻求书籍、工具、软件库等的推荐。您可以编辑问题，
Python 在第一行以外的任何行都找不到短语(新)
和我的last question ，我的程序无法检测到一个短语并将其与第一行以外的任何行匹配。但是，我已经解决并回答了。但现在我需要一个新的 def函数，它删除某个(给定 refName )联系人及其
html - (新)制作水平列表
这个问题在这里已经有了答案: Horizontal list items (7 个答案) 关闭 9 年前。
c++ - 新 float
我想创建一个新的 float 类型，大小为 128 位，指数为 4 字节(32 位)，小数为 12 字节(96 位)，我该怎么做输入 C++，我将能够在其中进行输入、输出、+、-、*、/操作。 [我正
c++ - 安置问题 - 新!
我在放置引用计数指针的实例时遇到问题类到我的数组类中。使用调试器，似乎永远不会调用构造函数(这会扰乱引用计数并导致行中出现段错误)! 我的 push_back 函数是: void push_back
c++ - 新/删除运算符不匹配错误有多严重？
我在我们的代码库中发现了经典的新建/删除不匹配错误，如下所示: char *foo = new char[10]; // do something delete foo; // instead of
c++ - A *a = 新 A();这会创建一个指针还是一个对象？
A *a = new A(); 这是创建一个指针还是一个对象？我是一个 c++ 初学者，所以我想了解这个区别。最佳答案两者:您创建了一个新的 A 实例(一个对象)，并创建了一个指向它的名为 a

首页

博学

6Ren·AI

商城

r - 变异多个变量以创建多个新变量