python - 在 pandas 数据框中逐行计算 CAGR？-6ren

python - 在 pandas 数据框中逐行计算 CAGR？

转载作者：太空宇宙更新时间：2023-11-03 14:59:01

26

4

我正在处理公司数据。我有一个大约 1900 家公司(索引)和每家公司 30 个变量(列)的数据集。这些变量总是三个成对出现(三个句点)。基本上看起来像这样

df = pd.DataFrame({'id' : ['1','2','3','7'],
                       'revenue_0' : [7,2,5,4],
                       'revenue_1' : [5,6,3,1],
                       'revenue_2' : [1,9,4,8],
                       'profit_0' : [3,6,4,4],
                       'profit_1' : [4,6,9,1],
                       'profit_2' : [5,5,9,8]})

我正在尝试计算 compound annual growth rate (CAGR)例如revenue对于每个公司 ( id ) - 这样 revenue_cagr = ((revenue_2/revenue_1)^(1/3))-1

我想将一个函数逐行传递给一组列 - 至少，这是我的想法。

def CAGR(start_value, end_value, periods): 
    ((end_value/start_value)^(1/periods))-1

是否可以对一组列逐行应用此函数(可能使用 for i, row in df.iterrows(): 或 df.apply() )？分别来说，有没有更聪明的方法来做到这一点？

更新

期望的结果 - 如 revenue_cagr 列所示- 应如下所示:

df = pd.DataFrame({'id' : ['1','2','3','7'],
                           'revenue_0' : [7,2,5,4],
                           'revenue_1' : [5,6,3,1],
                           'revenue_2' : [1,9,4,8],
                           'profit_0' : [3,6,4,4],
                           'profit_1' : [4,6,9,1],
                           'profit_2' : [5,5,9,8],
                           'revenue_cagr' : [-0.48, 0.65, -0.07, 0.26],
                           'profit_cagr' : [0.19, -0.06, 0.31, 0.26]
                  })

最佳答案

您可以使用set_index + str.rsplit首先是三元组:

df1 = df.set_index('id')
df1.columns = df1.columns.str.rsplit('_', expand=True, n=1)   
print (df1)
   profit       revenue      
        0  1  2       0  1  2
id                           
1       3  4  5       7  5  1
2       6  6  5       2  6  9
3       4  9  9       5  3  4
7       4  1  8       4  1  8

然后除以 div xs 选择的所有具有 0 级别的 2 ，添加pow , sub和 add_suffix :

df1 = df1.xs('2', axis=1, level=1)
         .div(df1.xs('0', axis=1, level=1))
         .pow((1./3))
         .sub(1)
         .add_suffix('_cagr')
print (df1)
    profit_cagr  revenue_cagr
id                           
1      0.185631     -0.477242
2     -0.058964      0.650964
3      0.310371     -0.071682
7      0.259921      0.259921

最后join原文:

df = df.join(df1, on='id')
print (df)
  id  profit_0  profit_1  profit_2  revenue_0  revenue_1  revenue_2  \
0  1         3         4         5          7          5          1   
1  2         6         6         5          2          6          9   
2  3         4         9         9          5          3          4   
3  7         4         1         8          4          1          8   

   profit_cagr  revenue_cagr  
0     0.185631     -0.477242  
1    -0.058964      0.650964  
2     0.310371     -0.071682  
3     0.259921      0.259921

关于python - 在 pandas 数据框中逐行计算 CAGR？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/45278459/

26

4

0

文章推荐： ssl - Glass fish HTTPS 重定向到不同的 URL

文章推荐： c# - ModalPopupExtender 未从页面加载后的代码中显示

文章推荐：具有奇怪输出错误的 Python 线程

逐 block 读取文件时Python不返回所有数据
我正在使用 python 加密一些文件，但我在逐 block 读取文件时遇到问题。有时不会返回最后一个 block 的所有数据。当文件长度为 307200 字节时，我没有问题。当它的长度为 279
html - 逐 block 下载文件客户端
我正在使用 WebRTC 将文件发送到连接的对等方，并且我正在以块的形式发送文件。但是，我无法弄清楚如何让对等方在文件逐块流入时保存/下载文件。我在网上找到的所有例子都推荐做这样的事情: // se
c++ - 逐 block 移动
我用 Tiled 做了一张 map 。它的每一 block 图 block 都尺寸为 32x32 像素，我的主要角色 Sprite 也是。在我的类(class) Player.cpp 中，我有一些计
jquery - 逐 block 滚动站点
我见过一些单页网站，您可以逐 block 滚动，因此您没有无限滚动。你逐 block 移动。是否有提供此功能的任何脚本或其他东西？最佳答案我自己从未使用过它，所以我无法在代码方面为您提供帮助，
c - 逐 block 反转文件内容
这是一个逐 block 反转文件内容的程序。 #include #include #define BS 12 void reverse(char * buffer, int size) { c
c - 逐 block 传输优化循环
在下面的代码中，有没有办法避免 if 语句？ s = 13; /*Total size*/ b = 5; /*Block size*/ x = 0; b1 = b; while(x s)
c++ - 逐 block 模糊图像
我正在尝试分割输入图像并逐个对其进行模糊处理，但毕竟对相邻图 block 调用 cv::blur 我得到了边界像素，这与我有一次将 cv::blur 集体应用于整个图像。 Mat upper(im,
java - 逐 block 读取文件
我想逐个读取文件。该文件被分成几部分，存储在不同类型的媒体上。我目前所做的是调用文件的每个单独部分，然后将其合并回原始文件。问题是我需要等到所有 block 都到达后才能播放/打开文件。是否可以在
json - 逐 block 解析 JSON
我有一个包含客户和日期列表的 JSON 文件。文件看起来像这样: { "Customers": [ { "Customer": "Customer Name Here", "Company"
http - golang从套接字解析分块的HTTP响应-逐 block 读取
我的邮件目标是从连接到HTTP服务器的TCP套接字读取数据，然后解析 HTTP响应块(传输编码:分块)-服务器在同一连接上每30秒发送一个块我附上了我的代码。看起来io.Copy读取第一个块，然后等
python - Numpy 逐 block 减少操作
我认为自己是一位经验丰富的 numpy 用户，但我无法找到以下问题的解决方案。假设有以下数组: # sorted array of times t = numpy.cumsum(numpy.rando
git - 逐 block 应用提交 block
当我将文件添加到暂存区时，我可以 $ git add my_file -p 然后选择我要暂存的 block 。有没有办法 merge/挑选一个提交并逐 block 应用它的差异？谢谢最佳答案我
c# - 逐 block 迭代 mongodb 结果
我有一个 mongodb 查询，它获取大约 50,000 个大文档。这对我的 RAM 来说太多了，因此计算机速度变慢了。现在我想逐 block 迭代 mongodb 结果。我想获取前 1000
java - RSA 逐 block 加密对大于 1kb 的文件产生空白输出
我不会为 AES 或其他加密打开此线程，因为这是我要用来加密 AES 和其他加密的 key 的内容。我从 StackOverflow 和其他一些网站收集了一些代码，并对其进行了编辑以适合我的程序，但是
linux - 逐 block 处理日志，每个 block 包含多行
我在做一些后台工作时尝试收集所有系统统计数据。例如，我使用以下命令来收集 IO 统计信息: iostat -xty 5 此脚本用于每 5 秒收集一次 I/O 统计信息。所以我的日志会包含很多数据 bl
php - 使用 php curl 逐 block 下载大文件
我需要 php 脚本，用于从 url 到服务器的可恢复文件下载。它应该能够开始下载，然后在捕捉时(30 秒 - 5 分钟)恢复，依此类推，直到完成整个文件。 perl 中有类似的东西 http://c
逐 block 读取/打印文件的 Linux shell 命令
是否有标准的 Linux 命令可用于逐 block 读取文件？例如，我有一个大小为 6kB 的文件。我想读取/打印第一个 1kB，然后是第二个 1kB ...似乎 cat/head/tail 在这种情
scala - 如何使用 Spark Structured Streaming 逐 block 处理文件？
我正在处理大量文件，我想逐 block 处理这些文件，假设在每批处理中，我想分别处理每 50 个文件。如何使用 Spark Structured Streaming 来实现？我看到 Jacek L
scala - 如何使用 Spark Structured Streaming 逐 block 处理文件？
我正在处理大量文件，我想逐 block 处理这些文件，假设在每批处理中，我想分别处理每 50 个文件。如何使用 Spark Structured Streaming 来实现？我看到 Jacek L
c++ - 如何使用 openJPEG C++ 逐 block 读取 JP2
我想知道:逐 block 读取 jp2 并将数据存储在缓冲区对象中的预期方法是什么？现在我正在做类似的事情。 /* note I already created stream and configu

首页

博学

6Ren·AI

商城

python - 在 pandas 数据框中逐行计算 CAGR？

更新