- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一张 table , table 上有多个用户,我想知道每天的钱的总余额。
每个用户都可以在一天内进行交易,我可以看到他们的总余额,但我想看到他们每天结束时的总余额。
所以如果我今天没有加入但昨天我想在今天添加明天的余额如果我昨天加入并进行交易我想为用户更新余额。
SUM(total) OVER (PARTITION BY user ORDER BY DATE(time) ROWS UNBOUNDED PRECEDING) gain,
我可以进行分区,但我想知道我可以在 SQL 中逻辑地进行分区吗?
| Date | User | Balance
+------+------+--------
| Day1 | A | 100
| Day1 | B | 50
| Day1 | C | 100
| Day2 | A | 150
| Day2 | B | 20
| Day3 | E | 100
| Day4 | F | 200
| Day5 | A | 50
| Day5 | F | 50
所以
等等..
最佳答案
很有意思的问题! :)
SELECT
the_date,
SUM(balance)
FROM (
SELECT DISTINCT ON (the_date, elems -> 'the_user')
the_date,
elems ->> 'the_user' AS the_user,
(elems ->> 'balance')::int AS balance
FROM (
SELECT
the_date::date AS the_date,
jsonb_agg(
row_to_json(mytable)::jsonb
) OVER (ORDER BY the_date) as agg
FROM
mytable
) s,
jsonb_array_elements(agg) as elems
ORDER BY the_date, elems -> 'the_user', elems -> 'the_date' DESC
) s
GROUP BY the_date
想法的草图:
1 累计聚合所有记录。 (为了以后能够访问每一列,这些记录在查询中存储为 JSON 对象)。
这在
中产生date data cum_data
Day1 (A:100) [(A:100)]
Day1 (B:50) [(A:100),(B:50)],
Day1 (C:100) [(A:100),(B:50),(C:100)],
Day2 (A:150) [(A:100),(B:50),(C:100),(A:150)],
Day2 (B:20) [(A:100),(B:50),(C:100),(A:150),(B:20)]
可以看到,每天的最后一条记录保存了所有相关数据。每个用户的相关数据是数组中的最后一个元素。
2 因此,之后您对 (1.) 每天的最后一条记录以及在此 (2.) 每个用户的最后一条记录感兴趣。所以,你必须先扩展记录:
date cum_data expansion
Day1 [(A:100)] (A:100)
Day1 [(A:100),(B:50)], (A:100)
(B:50)
Day1 [(A:100),(B:50),(C:100)], (A:100) <- last A day1
(B:50) <- last B day1
(C:100) <- last C day1
Day2 [(A:100),(B:50),(C:100),(A:150)], (A:100)
(B:50)
(C:100)
(A:150)
Day2 [(A:100),(B:50),(C:100),(A:150),(B:20)] (A:100)
(B:50)
(C:100) <- last C day2 (unchanged)
(A:150) <- last A day2 (changed)
(B:20) <- last B day2 (changed)
3 因此,下一步是获取每个用户每天的最后一次出现。这可以通过 DISTINCT ON
来完成,它获取有序组的第一条记录。在您的情况下,组是 (date, user)
并且订单是按用户的日期 DESC
排序的。用户的日期当然存储在 json 中。所以 (A:100)
实际上是 (A:100, day1)
而 (A:150)
是 (A: 150,第 2 天)
。顺序由第二个元素决定。当然,要先获取最新的,顺序需要降序。
这产生了
date cum_data expansion
Day1 [(A:100),(B:50),(C:100)], (A:100) <- last A day1
(B:50) <- last B day1
(C:100) <- last C day1
Day2 [(A:100),(B:50),(C:100),(A:150),(B:20)] (C:100) <- last C day2 (unchanged)
(A:150) <- last A day2 (changed)
(B:20) <- last B day2 (changed)
4 这最终可以简单地按date
列进行分组和总结:
date sum
Day1 (A:100) + (B:50) + (C:100) = 250
Day2 (C:100) + (A:150) + (B:20) = 270
当然,对于大型数据集,累积的性能会非常低。在这种情况下,我建议编写一个循环遍历所有记录的简单函数;像这样:
date list := empty list of (date, balance)
user list := empty list of (user, balance)
for all records:
get current date
if current date <> previous date
add element (previous date, sum(all balances in user list)) to date list
get current user
if current user already exists in user list then
replace its balance
else
add current user to user list
return date list
编辑:这是一个可能的函数(比查询快得多)。它完全遵循给定的伪代码。这只是第一次抛出,我相信你可以优化代码,所以请把这个也看成草图:
CREATE OR REPLACE FUNCTION foobar() RETURNS SETOF record
AS $$
DECLARE
_record record;
_date_rec record;
_prev_date date;
_user_balance int;
_date_balance int;
BEGIN
CREATE TEMP TABLE user_recs (the_user text, balance int);
FOR _record IN
SELECT * FROM mytable ORDER BY the_date
LOOP
IF (_prev_date IS NOT NULL AND (_record.the_date::date > _prev_date )) THEN
SELECT
SUM(ur.balance)
FROM
user_recs ur
INTO _date_balance;
_date_rec = (_prev_date , _date_balance);
RETURN NEXT _date_rec;
END IF;
SELECT balance FROM user_recs ur WHERE ur.the_user = _record.the_user
INTO _user_balance;
IF _user_balance IS NULL THEN
INSERT INTO user_recs VALUES (_record.the_user, _record.balance);
ELSE
UPDATE user_recs ur SET balance = _record.balance WHERE ur.the_user = _record.the_user;
END IF;
_prev_date = _record.the_date;
END LOOP;
RETURN QUERY
SELECT
_prev_date,
SUM(ur.balance)::int
FROM
user_recs ur;
END;
$$ LANGUAGE 'plpgsql'
关于每天的 SQL 累计总和用每个用户的新余额刷新,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/57583374/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!