gpt4 book ai didi

python - 如何使用 Pandas 从所选行的总和中获取百分比?

转载 作者:行者123 更新时间:2023-12-01 07:58:44 25 4
gpt4 key购买 nike

我需要从 DF 中选定的行组中获取值的总和,然后计算组中每行的百分比。

df = pd.read_csv("file.csv")

names = df.groupby(["Names", "Action"]).size().reset_index(name='counts')

names.rename(columns={"counts":"Count"}, inplace=True)

像这样获取 DF:

  Name    Action     Count
0 Name1 Action 1 7
1 Name1 Action 2 3
2 Name1 Action 3 720
3 Name1 Action 4 95
4 Name1 Action 5 301
5 Name1 Action 6 1
6 Name2 Action 1 17
7 Name2 Action 2 1
8 Name3 Action 1 1
9 Name3 Action 2 23
10 Name3 Action 3 170

对于每个名称,我都有不同的操作和相应的编号。我需要计算每个名称的所有类型操作的总数(对于 Name1,我们将是 1127)。在我需要将列“总计的%”添加到 DF 后,该列将显示每个给定名称的总计中每行值的百分比。 “% of Total”列中的每个“名称组”(Name1、Name2...)行都将拥有自己的 100% 百分比。
它应该看起来像这样:

  Name    Action     Count  % of Total
0 Name1 Action 1 7 0.62
1 Name1 Action 2 3 0.27
2 Name1 Action 3 720 63.89
3 Name1 Action 4 95 8.43
4 Name1 Action 5 301 26.71
5 Name1 Action 6 1 0.09
6 Name2 Action 1 17 94.44
7 Name2 Action 2 1 5.56
8 Name3 Action 1 1 0.52
9 Name3 Action 2 23 11.86
10 Name3 Action 3 170 87.63

为了获取每个名称的所有“Action”值的总和,我创建了一个新的 DF:

df_total = df.groupby(["Name"]).size().reset_index(name='counts_new')

Df 看起来像这样:

  Name  counts_new
0 Name1 1127
1 Name2 18
2 Name3 194
3 Name4 1377
4 Name5 93
5 Name6 1627
6 Name7 1355
7 etc...

现在我的计划是通过一些计算向 Df 添加列。但我不明白如何编写代码,其中:具有 Name1 的每一行将采用 df_total 中的相应行(具有 Name1)进行计算。

当我得到这个(我知道这是不对的)时,它只是从 DF 中获取第一行,并使用 df_total 中的第一行以及第二、第三行执行计算。这会得到所有错误的结果。

names["% of Total"] = df["Count"] * 100 / df_total["counts_new"]

Name Action Count % of Total
0 Name1 Action 1 7 0.621118
1 Name1 Action 2 3 16.666667
2 Name1 Action 3 720 371.134021
3 Name1 Action 4 95 6.899056
4 Name1 Action 5 301 323.655914
5 Name1 Action 6 1 0.061463
6 Name2 Action 1 17 1.254613
7 Name2 Action 2 1 0.125945

将不胜感激任何帮助。谢谢。

最佳答案

IIUC,使用变换

df['pctg'] = df.Count / df.groupby(['Name']).Count.transform('sum') * 100

输出

    Name    Action      Count   pctg
0 Name1 Action 1 7 0.621118
1 Name1 Action 2 3 0.266193
2 Name1 Action 3 720 63.886424
3 Name1 Action 4 95 8.429459
4 Name1 Action 5 301 26.708075
5 Name1 Action 6 1 0.088731
6 Name2 Action 1 17 94.444444
7 Name2 Action 2 1 5.555556
8 Name3 Action 1 1 0.515464
9 Name3 Action 2 23 11.855670
10 Name3 Action 3 170 87.628866

关于python - 如何使用 Pandas 从所选行的总和中获取百分比?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/55817514/

25 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com