python - Pandas - 重采样和标准差-6ren

python - Pandas - 重采样和标准差

转载作者：行者123 更新时间：2023-12-02 15:33:48

28

4

我有这个数据框:

startTime     endTime  emails_received
index                                             
2014-01-24 14:00:00  1390568400  1390569600    684
2014-01-24 14:00:00  1390568400  1390569300    700
2014-01-24 14:05:00  1390568700  1390569300    438
2014-01-24 14:05:00  1390568700  1390569900    586
2014-01-24 16:00:00  1390575600  1390576500    752
2014-01-24 16:00:00  1390575600  1390576500    743
2014-01-24 16:00:00  1390575600  1390576500    672
2014-01-24 16:00:00  1390575600  1390576200    712
2014-01-24 16:00:00  1390575600  1390576800    708

我运行 resample("10min",how="median").dropna() 并得到:

                  startTime     endTime  emails_received
start                                             
2014-01-24 14:00:00  1390568550  1390569450    635
2014-01-24 16:00:00  1390575600  1390576500    712

这是正确的。有什么方法可以通过 pandas 轻松获得平均值的标准差吗？

最佳答案

您只需要在您的 DataFrame 上调用 .std()。这是一个说明性示例。

创建一个DatetimeIndex

In [38]: index = pd.DatetimeIndex(start='2000-1-1',freq='1T', periods=1000)

创建一个包含 2 列的 DataFrame

In [45]: df = pd.DataFrame({'a':range(1000), 'b':range(1000,3000,2)}, index=index)

DataFrame 的 Head、Std 和 Mean

In [47]: df.head()Out[47]:                      a     b2000-01-01 00:00:00  0  10002000-01-01 00:01:00  1  10022000-01-01 00:02:00  2  10042000-01-01 00:03:00  3  10062000-01-01 00:04:00  4  1008In [48]: df.std()Out[48]: a    288.819436b    577.638872dtype: float64In [49]: df.mean()Out[49]: a     499.5b    1999.0dtype: float64

下采样并执行计算相同的统计分数

In [54]: df = df.resample(rule="10T",how="median")In [55]: dfOut[55]: DatetimeIndex: 100 entries, 2000-01-01 00:00:00 to 2000-01-01 16:30:00Freq: 10TData columns (total 2 columns):a    100  non-null valuesb    100  non-null valuesdtypes: float64(1), int64(1)In [56]: df.head()Out[56]:                         a     b2000-01-01 00:00:00   4.5  10092000-01-01 00:10:00  14.5  10292000-01-01 00:20:00  24.5  10492000-01-01 00:30:00  34.5  10692000-01-01 00:40:00  44.5  1089In [57]: df.std()Out[57]: a    290.11492b    580.22984dtype: float64In [58]: df.mean()Out[58]: a     499.5b    1999.0dtype: float64

通过`std()`进行下采样

In [62]: df2 = df.resample(rule="10T", how=np.std)In [63]: df2Out[63]: DatetimeIndex: 100 entries, 2000-01-01 00:00:00 to 2000-01-01 16:30:00Freq: 10TData columns (total 2 columns):a    100  non-null valuesb    100  non-null valuesdtypes: float64(2)In [64]: df2.head()Out[64]:                            a         b2000-01-01 00:00:00  3.02765  6.0553012000-01-01 00:10:00  3.02765  6.0553012000-01-01 00:20:00  3.02765  6.0553012000-01-01 00:30:00  3.02765  6.0553012000-01-01 00:40:00  3.02765  6.055301

以下是 .std() 方法的文档字符串中的信息。

Return standard deviation over requested axis.NA/null values are excludedParameters----------axis : {0, 1}    0 for row-wise, 1 for column-wiseskipna : boolean, default True    Exclude NA/null values. If an entire row/column is NA, the result    will be NAlevel : int, default None    If the axis is a MultiIndex (hierarchical), count along a    particular level, collapsing into a DataFrameReturns-------std : Series (or DataFrame if level specified)        Normalized by N-1 (unbiased estimator).

关于python - Pandas - 重采样和标准差，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/21480041/

28

4

0

文章推荐： Django分页随机: order_by ('?' )

文章推荐： objective-c - 什么是 "parent"和 "child"对象？

文章推荐： php - 列出一个类别和子类别中的所有维基百科文章

node.js - Chrome 的跟踪事件分析工具中的自上而下(树)、自上而下(重)和自下而上(重)有什么区别
我正在尝试使用谷歌浏览器的 Trace Event Profiling Tool分析我正在运行的 Node.js 应用程序。选择点样本后，我可以在三种 View 之间进行选择: 自上而下(树) 自上而
android - 重 ContentProvider 查询和 ListView
对于一个可能是菜鸟的问题，我们深表歉意，但尽管在 SO 上研究了大量教程和其他问题，但仍找不到答案。我想做的很简单:显示一个包含大量数据库存储字符串的 Android ListView。我所说的“很
css - 基础 5 div 重
我已经开始了一个新元素的工作，并决定给 Foundation 5 一个 bash，看看它是什么样的。在创建带有水平字段的表单时，我在文档中注意到的第一件事是它们使用大量 div 来设置样式。所以我在下
.net - 重 CPU 负载下的跨线程 BeginInvoke 阻塞
我有一个 Windows 窗体用户控件，其中包含一个使用 BeginInvoke 委托(delegate)调用从单独线程更新的第 3 方图像显示控件。在繁重的 CPU 负载下，UI 会锁定。当我附加
javascript - 什么是测试 Dom 重 js 的好方法？
我有一堆严重依赖dom元素的JS代码。我目前使用的测试解决方案依赖于 Selenium ，但 AFAIK 无法正确评估 js 错误(addScript 错误不会导致您的测试失败，而 getEval 会
Java Swing 重/慢 paintComponent - 有什么建议吗？
我正在制作一款基于滚动 2D map /图 block 的游戏。每个图 block (存储为图 block [21][11] - 每个 map 总共 231 个图 block )最多可以包含 21 个
javascript - 在网页上 - 如何显示(轻)图像并在客户端下载后者时将其替换为(重)图像？
考虑到以下情况，我是前端初学者: 某个 HTML 页面应该包含一个沉重的图像(例如 - 动画 gif)，但我不想强制客户缓慢地等待它完全下载才能享受一个漂亮的页面，而是我更愿意给他看一个轻量级图像(例
python - 重 I/O 和 python 多处理/多线程
我正在设计一个小软件，其中包括: 在互联网上获取资源，一些用户交互(资源的快速编辑)，一些处理。我想使用许多资源(它们都列在列表中)来这样做。每个都独立于其他。由于编辑部分很累，我想让用户(可能
c# - 重 I/O 操作中的 Parallel.ForEach 与异步 For 循环
我想比较两个理论场景。为了问题的目的，我简化了案例。但基本上它是您典型的生产者消费者场景。 (我关注的是消费者)。我有一个很大的Queue dataQueue我必须将其传输给多个客户端。那么让我们
python - K 重 CV 的变体，其中 size(test_set) > N/K
我有一个二元分类问题，标签 0 和 1(少数)存在巨大不平衡。由于测试集带有标签 1 的行太少，因此我将训练测试设置为至少 70-30 或 60-40，因此仍然有重要的观察结果。由于我没有过多地衡量准

首页

博学

6Ren·AI

商城

python - Pandas - 重采样和标准差

通过`std()`进行下采样

首页

博学

6Ren·AI

商城

python - Pandas - 重采样和标准差

通过std()进行下采样

通过`std()`进行下采样