- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我想了解您对一种更优雅的方式来计算前几天发生的事件数量的想法。我的代码(如下)可以工作,但它不是很好,也不是可扩展的。我正在尝试访问底部的表(desired_table)。有什么想法吗?
我想以比这更优雅的方式计算前几天事件的总和。
require(data.table)
# simulating an example data.table
date <- c("2000-01-01", "2000-01-04", "2000-01-05", "2000-01-06", "2000-01-01", "2000-01-02", "2000-01-03", "2000-01-04", "2000-01-05", "2000-01-06" , "2000-01-01", "2000-01-04", "2000-01-05", "2000-01-06", "2000-01-01", "2000-01-02", "2000-01-03", "2000-01-04", "2000-01-05", "2000-01-06")
cohort <- c("a", "b", "c")
zz <- data.table(DATE = date, COHORT = cohort)
zz$DATE <- as.Date(zz$DATE) # making sure the date is in the correct format
# adding on some other date fields so we can summarise by these days as well
zz$d1 <- zz$DATE +1 # will become "yesterday" when joined
zz$d2 <- zz$DATE +2 # will become "day before yesterday", when joined
# summarising the data for the first date
summary1 <- zz[,list(events_today = .N ), by= c("DATE", "COHORT")]
# summarising the data for the previous
summary2 <- zz[,list(events_yesterday = .N ), by= c("d1", "COHORT")]
# summarising the data for the day before yesterday
summary3 <- zz[,list(events_day_before_yesterday = .N ), by= c("d2", "COHORT")]
# merging the tables together
summary1.2 <- merge(summary1, summary2, by.x = c("DATE", "COHORT"), by.y = c("d1", "COHORT"), all = TRUE)
# merging the tables together to join on third summary table.
desired_table <- merge(summary1.2, summary3, by.x = c("DATE", "COHORT"), by.y = c("d2", "COHORT"), all = TRUE)
print(desired_table)
必须有一种更优雅的方法来做到这一点吗?
我这里的例子很简单 - 实际上我可能想要对数千条记录和许多时间段执行此操作。
最佳答案
我认为更优雅的方式是
long_zz <- melt(zz, id.vars = "COHORT")
new_zz <- dcast(long_zz, COHORT + value ~ variable, fun = length, drop = FALSE, fill = NA)
new_zz
# COHORT value DATE d1 d2
# 1: a 2000-01-01 1 NA NA
# 2: a 2000-01-02 1 1 NA
# 3: a 2000-01-03 1 1 1
# 4: a 2000-01-04 NA 1 1
# 5: a 2000-01-05 2 NA 1
# 6: a 2000-01-06 2 2 NA
# 7: a 2000-01-07 NA 2 2
# 8: a 2000-01-08 NA NA 2
# 9: b 2000-01-01 2 NA NA
# 10: b 2000-01-02 NA 2 NA
# 11: b 2000-01-03 1 NA 2
# 12: b 2000-01-04 2 1 NA
# 13: b 2000-01-05 NA 2 1
# 14: b 2000-01-06 2 NA 2
# 15: b 2000-01-07 NA 2 NA
# 16: b 2000-01-08 NA NA 2
# 17: c 2000-01-01 1 NA NA
# 18: c 2000-01-02 1 1 NA
# 19: c 2000-01-03 NA 1 1
# 20: c 2000-01-04 2 NA 1
# 21: c 2000-01-05 2 2 NA
# 22: c 2000-01-06 NA 2 2
# 23: c 2000-01-07 NA NA 2
# 24: c 2000-01-08 NA NA NA
# COHORT value DATE d1 d2
这里,我首先将数据从宽格式转换为长格式,然后使用种姓将变量(DATE、d1、d2)再次拆分为列,同时计算每个 COHORT 中的行数,值组为每个变量。如果没有 drop = FALSE
,我们将错过第 24 行,其中 COHORT c 没有发生任何事件。
您可以使用
设置您的姓名setnames(new_zz, c("value", "DATE", "d1", "d2"), c("DATE", "events_today","events_yesterday","events_day_before_yesterday"))
mircobenchmark
- 你的方法(合并)与我的方法(long_wide)的结果:
Unit: milliseconds
expr min lq mean median uq max neval
merge 14.740983 18.534281 31.88430 21.223305 31.830966 353.3662 100
long_wide 5.102077 6.411999 10.82941 7.130821 8.884161 117.7351 100
关于r - 您知道一种更优雅的方法来计算前几天的事件数量吗?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/56990258/
前一段时间写过一篇文章《 实战,一个高扩展、可视化低代码前端,详实、完整 》,得到了很多朋友的关注。 其中的逻辑编排部分过于简略,不少朋友希望能写一些关于逻辑编排的内容,本文就详细讲述一下逻辑
我正在尝试以下 Java 片段: int[] testArray={10,20,30,40}; int i= 0; testArray[i++]= testArray[i++]+1; System.o
我想知道我是否可以通过某种方式在 C++ 中进行前/后函数调用。我有一个包含很多函数的包装器类,在每次调用包装器函数后,我应该调用另一个始终相同的函数。 所以我不想像这样对每个函数调用 postFun
我有一个像这样的头文件: #pragma once #include "gamestate.h" #include "ExitListener.h" class InitialGameState :
学习左值和右值。定义是任何可以是“地址”的东西都是左值,否则就是右值。 我检查了运算符的优先级,前缀和后缀增量都比“地址”运算符具有更高的优先级。 对于下面的两个例子,谁能解释一下为什么第一个“&++
在我的学习过程中,我遇到了前后迭代器,我想知道是否有办法让它们就地创建容器元素。从文档来看,容器似乎需要实现 push_back 函数才能与 back_iterator 一起使用。但是有没有一种方法可
我有两个关于 Java 中运算符优先级的类似问题。 第一个: int X = 10; System.out.println(X++ * ++X * X++); //it prints 1440 根据
请放轻松,不要对我开枪,因为我还是新手。 当我运行这段代码时,我完全糊涂了,终生无法弄清楚为什么: int y = 9; cout << "++y = " << ++y << "\n--y = " <
两种表达方式有区别吗: (*x)++ 和 ++(*x) 我可以看到这两个语句都替换了 *x 中 (*x+1) 的内容。但是它们之间有什么区别吗? 最佳答案 (*x)++ 计算为*x的值;作为副作用,*
我有一个如下所示的数据集: Date CONSUMER DISCR CONSUMER STAPLES ENERGY FINANCIALS HEALTH CARE
我希望检查名称字段中输入的前两个字符是否为字母 - 除此之外没有什么区别(空格、'、- 等都是公平的游戏)。这是我到目前为止所拥有的,但它不起作用。想法?谢谢! if (document.form01
我制作了一个简单的脚本,为像素和所有附近的像素着色为相同的颜色 Click foto
我需要编写一个循环,以下列格式输出从昨天算起的最近 30 天: 2014-02-02 2014-02-03 2014-02-04 ... 2014-03-04 我想我需要像这样使用循环: for ($
我正在做一些练习,但我对这个感到困惑: public static int f (int x, int y) { int b=y--; while (b>0) { if (x%2!=0
我需要一个 4 个字符的正则表达式。前 3 个字符必须是数字,最后 1 个字符必须是字母或数字。 我形成了这个,但它不起作用 ^([0-9]{3}+(([a-zA-Z]*)|([0-9]*)))?$
我需要编写一个循环,以下列格式输出从昨天算起的最近 30 天: 2014-02-02 2014-02-03 2014-02-04 ... 2014-03-04 我想我需要像这样使用循环: for ($
我有下面的程序,我试图找到前 1000 个素数的总和。在代码中,解决方案1和2有什么区别?为什么我不应该将 count 变量放在 if 条件之外?如果我把变量放在 if 之外,我显然没有得到我需要的答
这个问题在这里已经有了答案: Replace First N Occurrences in the String (7 个答案) 关闭 4 年前。 我有一个如下的字符串 const str = '_
我正在尝试测量以纳秒为单位的平均访问延迟,但在第一次迭代后我收到“段错误(核心转储)”。我错过了什么吗?我是否滥用了指针。这是导致错误的函数: #include #include #include
我有一个 SQL 问题 (MySQL)。我如何从下表创建一个新表(表名称:“well_master_prod_inj”)。 我需要按井名和日期聚合数据。我希望每个井名只有一行数据以及显示以下数据的列:
我是一名优秀的程序员,十分优秀!