sql - 每组 LIMIT - Google BigQuery/标准 SQL-6ren

sql - 每组 LIMIT - Google BigQuery/标准 SQL

转载作者：行者123 更新时间：2023-12-05 08:52:31

24

4

我有一个如下表(示例 here ):

CREATE TABLE topics (
  name varchar(64),
  url varchar(253),
  statistic integer,
  pubdate timestamp
);

INSERT INTO topics VALUES
('a',  'b',  100,  TIMESTAMP '2011-05-16 15:36:38'),  
('a',  'c',  110,  TIMESTAMP '2014-04-01 00:00:00'),  
('a',  'd',  120,  TIMESTAMP '2014-04-01 00:00:00'),  
('a',  'e',  90,   TIMESTAMP '2011-05-16 15:36:38'), 
('a',  'f',  80,   TIMESTAMP '2014-04-01 00:00:00'), 
('a',  'g',  70,   TIMESTAMP '2011-05-16 15:36:38'), 
('a',  'h',  150,  TIMESTAMP '2014-04-01 00:00:00'),  
('a',  'i',  50,   TIMESTAMP '2011-05-16 15:36:38'), 
('b',  'j',  10,   TIMESTAMP '2014-04-01 00:00:00'), 
('b',  'k',  11,   TIMESTAMP '2011-05-16 15:36:38'), 
('b',  'l',  12,   TIMESTAMP '2014-04-01 00:00:00'), 
('b',  'm',  9,    TIMESTAMP '2011-05-16 15:36:38'),
('b',  'n',  8,    TIMESTAMP '2014-04-01 00:00:00'),
('b',  'o',  7,    TIMESTAMP '2011-05-16 15:36:38'),
('b',  'p',  15,   TIMESTAMP '2014-04-01 00:00:00'), 
('b',  'q',  5,    TIMESTAMP '2011-05-16 15:36:38'),
('b',  'r',  2,    TIMESTAMP '2014-04-01 00:00:00')

我想根据每个 (name, date(pubdate)) 组合的 statistic 值来获取前两行。

换句话说，我想GROUP BY name, date(pubdate)，但没有聚合函数，结果只是根据它们的获取前两行每组的统计。 (所以，我知道它并不是真正的 GROUP BY，而是 greatest-n-per-group。)

我正在使用带有标准 SQL 的 Google Big Query。我看过其他一些 solutions但我不确定在这种情况下如何实现结果。

期望的结果:

name    url     statistic   date

a       b       100         2011-05-16
a       e       90          2011-05-16

a       h       150         2014-04-01
a       d       120         2014-04-01

b       m       9           2011-05-16
b       k       11          2011-05-16

b       l       12          2014-04-01
b       p       15          2014-04-01

最佳答案

以下是 BigQuery 标准 SQL

#standardSQL
SELECT * EXCEPT(arr) FROM (
  SELECT name, DATE(pubdate) day, 
    ARRAY_AGG(STRUCT(url, statistic) ORDER BY statistic DESC LIMIT 2) arr
  FROM `project.dataset.table`   
  GROUP BY name, day
), UNNEST(arr)
-- ORDER BY name, day

您可以使用问题中的样本数据进行测试，如以下示例所示

#standardSQL
WITH `project.dataset.table` AS (
  SELECT 'a' name, 'b' url,  100 statistic,  TIMESTAMP '2011-05-16 15:36:38' pubdate UNION ALL  
  SELECT 'a', 'c',  110,  '2014-04-01 00:00:00' UNION ALL  
  SELECT 'a', 'd',  120,  '2014-04-01 00:00:00' UNION ALL  
  SELECT 'a', 'e',  90,   '2011-05-16 15:36:38' UNION ALL 
  SELECT 'a', 'f',  80,   '2014-04-01 00:00:00' UNION ALL 
  SELECT 'a', 'g',  70,   '2011-05-16 15:36:38' UNION ALL 
  SELECT 'a', 'h',  150,  '2014-04-01 00:00:00' UNION ALL  
  SELECT 'a', 'i',  50,   '2011-05-16 15:36:38' UNION ALL 
  SELECT 'b', 'j',  10,   '2014-04-01 00:00:00' UNION ALL 
  SELECT 'b', 'k',  11,   '2011-05-16 15:36:38' UNION ALL 
  SELECT 'b', 'l',  12,   '2014-04-01 00:00:00' UNION ALL 
  SELECT 'b', 'm',  9,    '2011-05-16 15:36:38' UNION ALL
  SELECT 'b', 'n',  8,    '2014-04-01 00:00:00' UNION ALL
  SELECT 'b', 'o',  7,    '2011-05-16 15:36:38' UNION ALL
  SELECT 'b', 'p',  15,   '2014-04-01 00:00:00' UNION ALL 
  SELECT 'b', 'q',  5,    '2011-05-16 15:36:38' UNION ALL
  SELECT 'b', 'r',  2,    '2014-04-01 00:00:00' 
)
SELECT * EXCEPT(arr) FROM (
  SELECT name, DATE(pubdate) day, 
    ARRAY_AGG(STRUCT(url, statistic) ORDER BY statistic DESC LIMIT 2) arr
  FROM `project.dataset.table`  
  GROUP BY name, day
), UNNEST(arr)
ORDER BY name, day

结果

Row name    day         url statistic    
1   a       2011-05-16  b   100  
2   a       2011-05-16  e   90   
3   a       2014-04-01  h   150  
4   a       2014-04-01  d   120  
5   b       2011-05-16  k   11   
6   b       2011-05-16  m   9    
7   b       2014-04-01  p   15   
8   b       2014-04-01  l   12

关于sql - 每组 LIMIT - Google BigQuery/标准 SQL，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/56602480/

24

4

0

文章推荐： angular - 如何从ngrx store获取值

文章推荐： amazon-web-services - Cloudformation 从参数中删除破折号

c - C 标准 I/O 的限制以及为什么我们不能将 C 标准 I/O 与套接字一起使用
我最近在读 CSAPP。在 10.9 节中，它说标准 I/O 不应该与 socket 一起使用，原因如下: (1) The restrictions of standard I/O Restricti
(标准？)问题的编码设计
似乎是一个足够标准的问题，可以保证解决方案中的标准设计: 假设我想在文件中写入 x+2(或更少)个字符串。 x 字符串构成一个部分的内容，这两个字符串构成该部分的页眉和页脚。要注意的是，如果内容中没有
标准&有效的项目开发流程
代码版本管理在项目中，代码的版本管理非常重要。每个需求版本的代码开发在版本控制里都应该经过以下几个步骤。在master分支中拉取该需求版本的两个分支，一个feature分支，
查找不同值计数的 Hibernate 标准
我有以下sql查询，我需要获取相应的hibernate条件查询 SELECT COUNT(DISTINCT employee_id) FROM erp_hr_payment WHERE payment
Python MixIn 标准
所以我正在编写一些代码，并且最近遇到了实现一些 mixin 的需要。我的问题是，设计混音的正确方法是什么？我将使用下面的示例代码来说明我的确切查询。 class Projectile(Movable,
linux - 标准 |用包含双引号的环境变量替换值
我的环境变量包含如下双引号: $echo $CONNECT_SASL_JAAS_CONFIG org.apache.kafka.common.security.plain.PlainLoginModu
设置可选参数默认值的 phpdoc 标准？
示例: /** * This function will determine whether or not one string starts with another string. * @pa
不区分大小写的 Grails 标准
有没有办法在 Grails 中做一个不区分大小写的 in 子句？我有这个: "in"("name", filters.tags) 我希望它忽略大小写。我想我可以做一个 sqlRestriction
c++ - Boost库成为C++标准
我搜索了很长时间，以查找将哪些boost库添加到std库中，但是我只找到了一个新库的完整列表(如此处:http://open-std.org/jtc1/sc22/wg21/docs/library_t
vba - 在自动筛选中组合多个排除 (<>) 标准
我已经通过使用这个肮脏的黑客解决了我的问题: ' Filter managerial functions ActiveSheet.Range("$A$1:$BW$2211").Auto
Java:Applet 标准
因此，我很难理解我需要遵循的标准，以便我的 Java 程序能够嵌入 HTML。我是否只需将我的主类扩展到 Applet 类，或者我还需要做更多的事情吗？另外，在我见过的每个 Applet 示例中，它都
hibernate 标准。限制和最大日期
我对在 Hibernate 中使用限制有疑问。我必须创建条件，设置一些限制，然后选择日期字段最大值的记录: Criteria query = session.createCriteria(Stora
休眠+标准。如何在没有一个引用实体的情况下返回结果
我有标准: ICriteria criteria = Session.CreateCriteria() .SetFetchMode("Entity1", FetchMo
用于选择具有空子集合的所有实体的 nHibernate 标准
我很难编写条件来选择所有子集合或孙集合为空的实体。我可以将这些作为单独的条件来执行，但我无法将其组合成一个条件。类结构: public class Component { p
多对多实体属性的 Hibernate 标准
@Entity class A { @ManyToMany private List list; ... } @Entity class B { ... } 我想使用条件(不是 sql 查询)从 A
java hibernate 标准
我的数据库中有以下表结构: Table A: Table B: Table C: _______________
java - 标准(不适用)
请帮助我: 我有下一张 table : 单位 ID 姓名用户 ID 姓名利率单位 ID 用户 ID 我不明白如何从 SQL 创建正确的条件结构: 代码: SELECT * FROM Unit W
URL 结构最佳实践/标准
我正在构建一个包含项目的网站，每个项目都有一个页面，例如: website.com/book/123 website.com/film/456 website.com/game/789 每个项目都可以
NHibernate 标准 - 如何过滤属性组合
我需要使用两个属性的组合来过滤结果列表。一个简单的 SQL 语句如下所示: SELECT TOP 10 * FROM Person WHERE FirstName + ' ' + LastName L
java - 标准:搜索两个不同的实体类
我有一个“ super 实体”SuperEntity 和三个扩展父类(super class)的实体 ChildEntity1、...、ChildEntity3。搜索数据库中的所有实体很容易，即我们

首页

博学

6Ren·AI

商城

sql - 每组 LIMIT - Google BigQuery/标准 SQL