mongodb - 如何使用 Mongodb 进行聚合分组并显示其他字段？-6ren

mongodb - 如何使用 Mongodb 进行聚合分组并显示其他字段？

转载作者：可可西里更新时间：2023-11-01 09:52:22

28

4

我需要运行 group 两次才能找到评论中平均点赞数最高的帖子。以下是我查询的初始阶段。

db.posts.aggregate([
    {"$unwind": "$comments"},
    {"$match":
        {
            "$comments.type": {
                "$ne" : "spam"
            },
        }
    }
])

这是我在运行上面的查询后看到的。

    {
        "_id" : ObjectId("50b59cd75bed76f46522c465"),
        "comment_id" : 49,
        "post_id" : 29,
        "likes" : {
            "type" : "accepted",
            "like" : 3
        }
    },
    {
        "_id" : ObjectId("50b59cd75bed76f46522c465"),
        "comment_id" : 49,
        "post_id" : 29,
        "likes" : {
            "type" : "rejected",
            "like" : 7
        }
    }

我现在想做的是首先从这些有效记录中找出特定评论的平均点赞数，然后在每个帖子中，对每个评论的所有这些平均点赞数求和，然后除以每个帖子的评论总数。

请注意，comment_id 仅在同一 post_id 中是唯一的。意思是说，有post_id 28，comment_id 49的记录。

我试过这个查询。

db.posts.aggregate([
    {"$unwind": "$comments"},
    {"$match":
        {
            "$comments.type": {
                "$ne" : "spam"
            },
        }
    },
    {"$group" :
        {
            "_id": "$_id",
            "comment_avg":
            {
                "$avg":"$comments.like"
            }
        }
    }])

我得到以下信息:

{
            "_id" : ObjectId("50b59cd75bed76f46522c44d"),
            "comment_avg" : 61.074253191058865
        },
        {
            "_id" : ObjectId("50b59cd75bed76f46522c34e"),
            "comment_avg" : 46.82622896256565
        }

如您所见，我丢失了 post_id 信息。我试过 $project，但我想我一定做错了。

最佳答案

您尚未发布初始文档结构。

Document Structure:

{
    "_id" : ObjectId("50b59cd75bed76f46522c471"),
    "comment_id" : 61,
    "post_id" : 29,
    "comments" : [
                   {
                       "type" : "accepted",
                       "like" : 3
                   },
                   {
                      "type" : "rejected",
                      "like" : 3
                   },
                   {
                      "type" : "spam",
                      "like" : 3
                   }
                ]
}

假设您的文档结构如上，我编写了这个查询。您必须根据需要操纵它。

db.posts.aggregate([
        {$unwind:"$comments"},
        {$match:{"$comments.type":{$ne:"spam"}}},
        {$group:{_id:{post_id:"$post_id",comment_id:"$comment_id"},LikeSum:{$sum:"$comments.like"}}},
        {$group:{_id:{post_id:"$_id.post_id"},AvgComments:{$avg:"$LikeSum"}}},
        {$sort:{AvgComments:-1}},
        {$limit:1}
              ])

上面的查询构造如下:

1.) Unwind the comments array and form individual documents for each element in the comments array
2.) Select only the non-spam comments
3.) Calculate the sum of likes for each comment of all posts
4.) Calculate the average Comment likes for each post
5.) Sort documents in descending order of Average Comment Likes
6.) Select only the first document.

输出文档会是这样的

{
    "result" : [
        {
            "_id" : {
                       "post_id" : xx
                    },
            "AvgComments" : xx.xx // Avg Comment likes for post xx
        }
               ],
    "ok" : 1
}

关于mongodb - 如何使用 Mongodb 进行聚合分组并显示其他字段？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/20915148/

28

4

0

文章推荐： node.js - 如何在 Mongoose 的数组中使用不同类型的模式？

文章推荐： php - MongoDB:复合索引决策

文章推荐： MongoDB 查询嵌套文档列表

文章推荐：用于 Multi-Tenancy 的 MongoDB 'Manually Sharding'

mysql - 按 parent 分组，但不按 child 分组
您好，我正在处理 BIRT 报告。我有一个查询，我必须对父级的重复数据进行分组，但子级也不能分组! 在我的查询中: item 是父项，item_ledger_entry 是子项。我有来自 item.N
google-analytics - 为什么 MCF channel 分组≠默认 channel 分组？
我正在使用 GA API。这是针对 MCF 目标报告(底部)的标准目标完成指标表(顶部) 看一下这个: 总数加起来 (12,238)，但看看按 channel 分组的分割有多么不同!我以为这些会很接
OrientDB 分组
我正在开发一个流量计数器，我想获得 IP 和重复计数，但是如何？就像是 :select ip, count(ip) from Redirect 返回 : null total ip count 重定
Java正则表达式(分组)
我尝试编写一个正则表达式来匹配条件表达式，例如: a!=2 1+2=2+a 我尝试提取运算符。我当前的正则表达式是“.+([!=<>]+).+” 但问题是匹配器总是尝试匹配组中可能的最短字符串
分组、平均的SQL子查询问题
在 MS Transact SQL 中，假设我有一个这样的表(订单): Order Date Order Total Customer # 09/30/2008 8
MySQL:分组
我想按 m.ID 分组，并对每个 m.id 求和 (pm.amount_construction* prod.anzahl) 实际上我有以下结果: Meterial_id | amount_const
PostgreSQL 分组
我想根据多列中的值对值进行分组。这是一个例子: 我想得到输出: {{-30,-50,20},{-20,30,60},{-30,NULL or other value, 20}} 我设法到达: SELE
MySql 分组
我正在尝试找出运行此查询的最佳方式。我基本上需要返回在我们的系统中只下了一个订单的客户的“登录”字段列表(登录字段基本上是客户 ID/ key )。我们系统的一些背景...... 客户在同一日期下的
MYSQL - 分组
给定以下mysql结果集: id code name importance '1234', 'ID-CS-B', 'Chocolate Sauce'
python - 分组
大家好，我的数据框中有以下列: LC_REF 1 DT 16 2C 2 DT 16 2C 3 DT 16 2C 1 DT 16 3C 6 DT 16 3C 3
MongoDB 分组
我有这样的 mongoDB 集合 { "_id" : "EkKTRrpH4FY9AuRLj", "stage" : 10, }, { "_id" : "EkKTRrpH4FY9
Python 分组
假设我有一组数据对，其中 index 0 是值，index 1 是类型: input = [ ('11013331', 'KAT'), ('9085267',
java中用stream进行去重，排序，分组
java中用stream进行去重，排序，分组一、distinct 1. 八大基本数据类型 List collect = ListUtil.of(1, 2, 3, 1, 2).stream().fil
SQL - 如何添加具有平均值的列，分组
基本上，我从 TABLE_A 中的这个开始 France - 100 France - 200 France - 300 Mexico - 50 Mexico - 50 Mexico - 56 Pol
正则表达式，分组，查找最后一个匹配项
我希望这个正则表达式 ([A-Z]+)$ 将选择此示例中的最后一次出现: AB.012.00.022ABC-1 AB.013.00.022AB-1 AB.014.00.022ABAB-1 但我没有匹配
数据透视表中的 SQL 分组
我创建了一个数据透视表，但数据没有组合在一起。任何人都可以帮助我获得所需的格式吗？我为获取数据透视表而编写的查询: DECLARE @cols AS NVARCHAR(MAX), -- f
SQL选择并按一段时间(时间戳)分组
我想按时间段(月，周，日，小时，...)选择计数和分组。例如，我想选择行数并将它们按 24 小时分组。我的表创建如下。日期是时间戳。 CREATE TABLE MSG ( MSG_ID dec
围绕间隙的 SQL 分组
在 SQL Server 2005 中，我有一个包含如下数据的表: WTN------------Date 555-111-1212 2009-01-01 555-111-1212 2009-
python - 按多列对数据框中的连续条目进行聚类/分组
题假设我有 k 个标量列，如果它们沿着每列彼此在一定距离内，我想对它们进行分组。假设简单 k 是 2 并且它们是我唯一的列。 pd.DataFrame(list(zip(sorted(choice
pandas - 分组、拆分和选取数据框中的顶行
问题在以下数据框中 df : import random import pandas as pd random.seed(999) sz = 50 qty = {'one': 1, 'two': 2

首页

博学

6Ren·AI

商城

mongodb - 如何使用 Mongodb 进行聚合分组并显示其他字段？