r - 使用 tidyverse 清理排名选择调查-6ren

r - 使用 tidyverse 清理排名选择调查

转载作者：行者123 更新时间：2023-12-04 01:04:18

25

4

我在 R 中有这样的调查数据，其中我向人们展示了两组 Action - 高和低 - 并要求他们对每个 Action 进行排名。每组包含独特的 Action ，用字母标记(总共 6 个 Action )。

 id   A_High   B_High   C_High   D_Low   E_Low    F_Low
001       5         2         1      6       4        3
002       6         4         3      5       2        1
003       3         1         6      2       4        5
004       6         5         2      1       3        4

我需要一个类似于下图的新 df，其中每个高操作都分配了一个新的数字等级(介于 0 和 3 之间)，对应于排名低于的低操作项目的数量那个高 Action 。

例如，id 001 的人在 A_High 排名第 5，B_High 在 2，在 C_High 在 1。A_High 的新排名将为 1(因为只有 1 个 Low Action ，D_Low 排名低于 A_High)， B_High 的新排名将为 3(因为所有 3 个 Low Action 的排名都低于 B_High)，C_High 的新排名将为 3(因为所有 3 个 Low Action 的排名都低于 C_High).

 id   A_High_rank   B_High_rank   C_High_rank   
001             1             3             3                      
002             0             1             1           
003             2             3             0           
004             0             0             2

我觉得这可以通过 if/else 语句来完成，但怀疑应该有一种更有效的方法来使用 tidyverse 来实现这一点。在真实数据集中，我有 1000 多行和 12 个 Action (6 个高和 6 个低)。我将不胜感激。

谢谢!

数据:

"id   A_High   B_High   C_High   D_Low   E_Low    F_Low
001       5         2         1      6       4        3
002       6         4         3      5       2        1
003       3         1         6      2       4        5
004       6         5         2      1       3        4"

最佳答案

base R 选项将遍历“High”列，通过检查它是否小于“Low”来获取创建的逻辑矩阵的 rowSums列，并通过附加 _rank 作为后缀来重命名这些输出

out <- cbind(df1[1], sapply(df1[2:4],
    function(x) rowSums(x < df1[endsWith(names(df1), 'Low')])))
names(out)[-1] <- paste0(names(out)[-1], "_rank")

-输出

out
#  id A_High_rank B_High_rank C_High_rank
#1  1           1           3           3
#2  2           0           1           1
#3  3           2           3           0
#4  4           0           0           2

或者使用dplyr

library(dplyr)
df1 %>% 
     transmute(id, across(ends_with('High'), 
        ~  rowSums(. <  select(df1, ends_with('Low'))), .names = '{.col}_rank'))
# id A_High_rank B_High_rank C_High_rank
#1  1           1           3           3
#2  2           0           1           1
#3  3           2           3           0
#4  4           0           0           2

数据

df1 <- structure(list(id = 1:4, A_High = c(5L, 6L, 3L, 6L), B_High = c(2L, 
4L, 1L, 5L), C_High = c(1L, 3L, 6L, 2L), D_Low = c(6L, 5L, 2L, 
1L), E_Low = c(4L, 2L, 4L, 3L), F_Low = c(3L, 1L, 5L, 4L)), 
class = "data.frame", row.names = c(NA, 
-4L))

关于r - 使用 tidyverse 清理排名选择调查，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/67007041/

25

4

0

文章推荐： avalonedit - AvalonEdit XSHD-Ruleset(用于tex)

文章推荐： multithreading - boost 互斥量 C++/CLI 问题

文章推荐： ANTLR 解析器规则匹配 : x and/or y and/or z in any order

r 元素频率和索引，排名
我正在查看下面的示例代码， r element frequency and column name 并且想知道除了r中的排名和频率之外，是否有任何方法可以显示每列中每个元素的索引。因此，例如，所需的输
sql - 如何根据列的变化值对记录进行分组/排名？
我有下表按 Id、Year DESC 排序 ID 年份有效 1 2011 1 1 2010 1 1 2009 0 1 2002 1 4 2013 1 4 2012 1 4 2011 1 等等。我想要
SQL 排名，同时保持时间排序
鉴于此数据 Type Time Outcome Wanted Result 1 8:00 1 1 1 9:00 1 1 1 10:00 1 1 0
Java - 排名/匹配句子
我正在寻找一种对两个句子进行排名/匹配的方法。例如，取以下2个例句。这是一个简短的句子。这是一个包含很多单词的长句子。我的新句子是这是一个句子。我想将我的新句子与现有句子进行比较。我的新句子
python - Scikit分类比较/排名
我是 scikit 新手，我正在按照此处的示例 http://scikit-learn.org/stable/tutorial/text_analytics/working_with_text_dat
Mysql - 获取用户上下5行(排名)
我有一张 table : r_user | r_points | -------------------- user1 | 12 | user2 | 124 | use
MySql - 排名，给定玩家的排名及周围
我需要获得顶级玩家、给定玩家的排名以及与该给定玩家排名相关的少数玩家。为了更清楚地解释，下表是我想要的，它显示了得分最高的 3 名玩家、给定玩家的排名 (id=11) 以及得分略高于和低于该给定玩家
MySQL右外连接空值，所有用户的排名(排名)
我正在尝试创建一个排名(排名)查询。我使用表users、schedule 和picks来计算排名。然而，这样做的缺陷是，如果用户未提交任何选择，则该用户将不会出现在排名中。下面的查询返回所有已提交
php - 选择标识符并显示其中的行/排名
这个问题已经有答案了: 已关闭10 年前。 Possible Duplicate: High score system from my iphone game 我的查询是: $sql = "SELEC
mysql - 根据比赛表中的胜率获取排名/排名
我有一个玩家表和MatchUps表。 MatchUps 表具有一个 winner_id 列和一个 loser_id 列。我可以根据一次查询的胜率获得排名/排名吗？如果我能为每个玩家返回这样的东西，那就
php - 排名/天梯系统
我正在尝试创建一个排名/阶梯系统，其中排名最高的氏族 (1) 应位于顶部，排名为 2 的氏族应位于顶部，依此类推。但我无法让它工作......我尝试了不同的方法: PHP: $sql = mysql_
MySQL 排名(排名靠前的用户)
我需要一份游戏中排名最高的玩家列表。排名是即时计算的，数据取自两个表。我设法以正确的方式对它们进行排序，但是@rank:=0 -> @rank:=@rank+1 技巧，其中一个名为 rank 的附加字
mySQL 排名(和抽奖)
下周末我们将进行一场包含 3 项资格赛(半决赛和决赛)的比赛。只有最好的 15 名参赛者才能参加半决赛。只有最好的 6 人才能参加总决赛。在资格考试中，每项资格考试的分数从 0 到 100 不等我
php - 排名/人气系统
我正在尝试找出对我的产品进行加权的最佳方式，以及它们应该以何种顺序出现在主页等地方。我想处理四个指标并将其转化为排名: 购买产品产品有多久了(以天为单位) 产品被保存了多少次产品被浏览了多少次
使用变量在存在索引的情况下进行 MySQL 排名
使用 @N=@N + 1 的经典技巧来获取某些有序列上的项目排名。现在在订购之前，我需要通过将它与其他表内部连接来从基表中过滤掉一些值。所以查询看起来像这样 -: SET @N=0; SELECT
并列情况下的 MySQL 排名
我需要一些帮助来处理在 MySQL 中排名时的关系。例如: 播放器 |积分玛丽:90 鲍勃:90 吉姆:65 凯文:12 Bob 和 Mary 应该都排名第一。吉姆应该是#3。凯文应该是#4。 My
arrays - 具有特定强度的下一个排列/排名
我正在寻找一种算法，该算法可以为我提供具有特定强度的下一个排列。长度为 n 的排列由元素 (1,2,3,...n) 定义排列的强度是多少？长度为 10 的排列的强度定义为 |a1-a2|+|a2-
algorithm - 排名/信誉算法
我正在编写一个具有信誉组件的电子商务引擎。我希望用户能够对项目进行评论和评分，并能够对评论进行评分。用于根据“最佳”评论对项目进行排序的最佳算法是什么？它必须根据给出最佳评论的人获得的质量评论数量进
MySQL Volley 排名
我有一个按游戏结果填满游戏的数据库表，想知道我是否可以计算以下内容: GP(玩过的游戏) 获胜失败积分(每胜2分，每负1分) 这是我的表结构: CREATE TABLE `results` (
MySQL:获取特定行的行号(排名)
我有一个 users 表，其中有一列名为 money_sent。我想按 money_sent 降序排列此表，然后找出特定用户的“排名”。例如，只有 111 人比用户 12392 花费更多的钱，因此他

首页

博学

6Ren·AI

商城

r - 使用 tidyverse 清理排名选择调查

数据