python - Pandas 数据帧 : get average of first rows of each subgroup within a group-6ren

python - Pandas 数据帧 : get average of first rows of each subgroup within a group

转载作者：行者123 更新时间：2023-12-02 02:51:19

26

4

我有一个如下所示的 pandas 数据框:

df = pd.DataFrame({'Person_ID': [1,1,1,1,1,1,2,2,2,3,3,3,3],
                  'Item_ID': [1,1,2,4,4,4,2,3,3,1,2,2,2],
                   'Value': [1,4,6,5,8,7,3,2,9,8,4,1,2]})

我想按 person_id 和 item_id 对其进行分组，然后获取每个第一行的平均值。例如:Person_ID 1 与“Item_ID”的 1,2 和 4 “关联”。此 Person_ID 和这些组的第一个条目的值分别为 1,6 和 5。平均值为 4。

    Person_ID   Item_ID Value
0   1   1   1
1   1   1   4
2   1   2   6
3   1   4   5
4   1   4   8
5   1   4   7
6   2   2   3
7   2   3   2
8   2   3   9
9   3   1   8
10  3   2   4
11  3   2   1
12  3   2   2

期望的结果:

Person_ID Average_value_first_entries
1   4
2   2.5
3   6

我注意到这个问题很相似，但是这个问题的更复杂的版本: Pandas dataframe get first row of each group在这种情况下，我不想按一个“id”分组，而是想按两个“id”分组并取平均值。

我尝试了以下方法:

df.groupby(['Person_ID', 'Item_ID']).first()['Value']

但是，这会返回每个“第一个”条目，但不会返回平均值。

Person_ID  Item_ID
1          1          1
           2          6
           4          5
2          2          3
           3          2
3          1          8
           2          4
Name: Value, dtype: int64

如有任何帮助，我们将不胜感激。我特别感谢“计算高效”(时间)的解决方案，因为真实的数据集包含 120 万行。

最佳答案

找到每组 Person_ID 和 Item_ID 的 first 行后，您需要对 Person_ID 再次分组code> 求平均值。像这样:

In [1312]: d = df.groupby(['Person_ID','Item_ID'], as_index=False).head(1)

In [1315]: d.groupby('Person_ID', as_index=False)['Value'].mean()
Out[1315]: 
   Person_ID  Value
0          1    4.0
1          2    2.5
2          3    6.0

或者按照@Datanovice的建议在一行中:

In [1320]: df.groupby(['Person_ID','Item_ID']).first().groupby(level=0)['Value'].mean().to_frame().reset_index()
Out[1320]: 
   Person_ID  Value
0          1    4.0
1          2    2.5
2          3    6.0

关于python - Pandas 数据帧 : get average of first rows of each subgroup within a group，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/61924262/

26

4

0

文章推荐： c# - 在 Unity 中设置游戏对象颜色时出现奇怪的行为

文章推荐： scala - 对于 Haskell 中的列表理解，Scala 中的等价物？

文章推荐： javascript - 使用 turf.intersect 时出现 TopologyException

php - 调用成员函数 row() 错误 | $row = $query->row(); |代码点火器
首先我要说的是，我主要是一名 iOS 开发人员，最近才开始探索全栈开发的惊心动魄的冒险。我是 PHP 和 MySQL 的新手。话虽如此，我有一个问题，我希望需要一个直接的解决方案。我正在为一个拥有预
row - Janus GridEx : Add custom row and select a specific row
我的表单上有 GridEx 对象并且... 我想用 for...next 循环在其中添加一些项目。实际上我找不到任何方法来添加带有自定义数据的新行。我想在那个 GridEx 对象中选择一个特定的行。
Python Pandas : reusing row value to another row - lookup across row
我有以下数据框 df1 = DataFrame([['OBJ1', 10, 'BX', 'pool1', 'OBJ2'],['OBJ2', 0, '', '', 'OBJ1'],['OBJ3', 1
mysql : Previous Row data if data on another row is equal to data on current row
所以我有以下成员(member)历史表 User_ID | Start date | End Date | Type(0-7) | ---------------------------
mysql - SQL : combinig 2 rows into 1 row based on the first field in row
我不擅长sql。我查看了 stackoverflow，但似乎对我没有任何用处。所以，我正在寻求帮助。是否可以根据行中的第一个字段将 2 行合并为 1 行。我在 mysql 中执行此操作。我将展示示例
bootstrap-4 - Bootstrap Flex : What is the difference between row and flex-row, flex-sm-row 等
我了解 flex sm、md、lg 列的概念，但不了解应用于行的概念。弹性行有什么作用？ sm、md、lg 尺寸应用于弹性行时意味着什么？最佳答案简答 - .row只是网格的容器 col .然而，
mysql - SQL新手: How to compare all rows within a column to reflect how many rows are "cheaper/less than" the respective row?
我遇到麻烦的地方我相信我需要使用 COUNT；但是，我不知道如何将一行与同一列中的每一行进行比较，然后计算有多少行比相应行少/便宜。提前谢谢您! 这是我试图解决的官方问题: “使用示例架构，编写一条
sql : duplicate row and all related rows
我有以下 3 个相关表 Schools Departments Classes --------------- ------------------ --
python - 我不知道代码 "[:, row:row]"的含义
我有代码: g, g_err = data[:, 4:6].T 我不知道[:, 4:6]的含义尤其是第一个: .T 表示转置吗？最佳答案您有一个名为 data 的二维矩阵，您的代码从第一维获取所
javascript - row 事件在附加到 row 内元素的事件之前触发
我在行单击上附加了一个事件，在行内的复选框更改上附加了一个事件。如何防止首先触发行单击？ $(document).on('click', 'table tr', function() { con
sql-server - T-SQL : How to join tables without creating extra rows - need a one row to one row correspondance
我有一个场景，我需要连接两个 SQL 表并且正在为如何做而苦恼。假设在表 A 中我有这个: ColA ColB ColC ColD 45 55 17 45 45
When two cells A and B are in the same row, and cell A moves to a different row, is there a function to move cell B to the same row?(当两个单元格A和B在同一行，而单元格A移动到不同的行时，是否有将单元格B移动到同一行的函数？)
我用谷歌表格记录我们俱乐部的出席率。该表格链接到另一个谷歌表格，因此可以自动创建一个名字列表，并按字母顺序排序。在这张表格中，我还根据我们所做的活动，在人的名字旁边手动输入点数。。问题是，由于姓名列表
java - Row row = sheet.getRow(row Number) 即使 Excel 工作表中存在行，也会返回 java.lang.nullpointerexception。我正在使用 Apache POI
这个问题在这里已经有了答案: What is a NullPointerException, and how do I fix it? (12 个回答) 5年前关闭。编辑:我正在使用此代码读取 Ex
r - (函数(..., row.names = NULL, check.rows = FALSE, check.names = TRUE, : Arguments imply different number of rows: 1, 4, 5, 2
我是 R 的初学者。我希望你能帮助我解决我的问题。我的数据集中的文件名包含大量信息。我必须提取这些信息来创建单独的变量。首先我使用 splits <- t(as.data.frame(strspli
row - scipy.sparse : Set row to zeros
假设我有一个 CSR 格式的矩阵，将一行(或多行)设置为零的最有效方法是什么？下面的代码运行得很慢: A = A.tolil() A[indices, :] = 0 A = A.tocsr() 我不
r - 多行删除 : delete row depending on other row
我遇到了一个相当复杂的问题。我有一个包含三行的数据框:id、info 和 rownum。数据如下所示: id info row 1 a 1 1 b 2
javascript - `lookupIndex[row[lookupKey]] = row;` 是如何工作的？
我正在阅读learnjsdata.com并遇到了这种不熟悉的 JavaScript 语法。语法如下: lookupIndex[row[lookupKey]] = row; 有人知道这里发生了什么吗？我
mysql - mysql : Sum each row After Specific Row
我有一个表格，收集每周足球比赛的结果。根据每场比赛的结果，我根据 ID 为玩家输入 3、1 或 0 分，具体取决于他们是赢、平还是输。 id Name A1 B1 C1 A2 B2
MySQL : combine multiple row into one row
我有一个 mysql 表: 在表1中，我有3列:Bidang、Keahlian、Nilai。在 saran 列的表结果中，我想根据 bidang 组合 keahlian，但如果 nilai > 0，则
mysql - SQL : splitting a row in two rows
我有一个看起来像这样的表 | ID | item1 | item 2 | | 1 | A1 | B1 | | 2 | A2 |

首页

博学

6Ren·AI

商城

python - Pandas 数据帧 : get average of first rows of each subgroup within a group