- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
如果您的索引使用日期时间索引,Pandas 重采样真的很方便,但我还没有找到一个简单的实现来按任意因子重采样。例如,只需将每个索引视为一个任意索引,并对数据帧重新采样,使其结果长度缩短 4 倍(并且比仅取每 4 个数据点更智能)。
这对于处理在比日期时间短得多的时间尺度上运行的数据的任何人都非常有用。例如,在我的例子中,我想将音频矢量从 44KHz 重新采样到 11KHz。现在我必须使用 scipy 的“抽取”功能,然后将其重新转换回数据帧(使用 dataframe.apply 不起作用,因为它改变了数据帧的长度)。
有人对如何完成此任务有任何建议吗?
最佳答案
您可以使用 DatetimeIndex
对高频数据重新采样(精确到纳秒,警告:我相信这仅在即将发布的 0.13 版本中可用)。我已经成功地使用 pandas 对 24KHz 范围内的电生理数据进行了重新采样。这是一个例子:
In [97]: index = date_range('1/1/2001 00:00:00', '1/1/2001 00:00:01', freq='22727N')
In [98]: index
Out[98]:
<class 'pandas.tseries.index.DatetimeIndex'>
[2001-01-01 00:00:00, ..., 2001-01-01 00:00:00.999988]
Length: 44001, Freq: 22727N, Timezone: None
In [99]: s = Series(randn(index.size), index=index)
In [100]: s.head(10)
Out[100]:
2001-01-01 00:00:00 -0.820
2001-01-01 00:00:00.000022 -1.141
2001-01-01 00:00:00.000045 1.577
2001-01-01 00:00:00.000068 -1.031
2001-01-01 00:00:00.000090 0.343
2001-01-01 00:00:00.000113 -0.424
2001-01-01 00:00:00.000136 -0.753
2001-01-01 00:00:00.000159 0.411
2001-01-01 00:00:00.000181 0.238
2001-01-01 00:00:00.000204 1.048
Freq: 22727N, dtype: float64
In [101]: s.resample(s.index.freq * 4, how='mean')
Out[101]:
2001-01-01 00:00:00 -0.354
2001-01-01 00:00:00.000090 -0.106
2001-01-01 00:00:00.000181 0.245
2001-01-01 00:00:00.000272 0.568
2001-01-01 00:00:00.000363 0.047
2001-01-01 00:00:00.000454 -0.560
2001-01-01 00:00:00.000545 -0.485
2001-01-01 00:00:00.000636 -0.271
2001-01-01 00:00:00.000727 -0.457
2001-01-01 00:00:00.000818 0.078
2001-01-01 00:00:00.000909 0.394
2001-01-01 00:00:00.000999 0.185
2001-01-01 00:00:00.001090 -0.441
2001-01-01 00:00:00.001181 0.300
2001-01-01 00:00:00.001272 -0.521
...
2001-01-01 00:00:00.998715 -0.045
2001-01-01 00:00:00.998806 -0.044
2001-01-01 00:00:00.998897 0.090
2001-01-01 00:00:00.998988 0.748
2001-01-01 00:00:00.999078 -0.179
2001-01-01 00:00:00.999169 0.451
2001-01-01 00:00:00.999260 -1.041
2001-01-01 00:00:00.999351 -0.476
2001-01-01 00:00:00.999442 -0.234
2001-01-01 00:00:00.999533 -0.719
2001-01-01 00:00:00.999624 -0.606
2001-01-01 00:00:00.999715 -0.032
2001-01-01 00:00:00.999806 -0.296
2001-01-01 00:00:00.999897 -0.044
2001-01-01 00:00:00.999988 -0.951
Freq: 90908N, Length: 11001
您可以将一个可调用对象传递给how
,这样您就可以“做一些更智能的事情”。 pandas
默认取给定时间段内的平均值(在本例中,这是 22727 个样本的每个 block 的平均值)。
关于python - 通过任意因子重新采样 Pandas 数据框,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/19896103/
我有这种格式的data.frame: 'data.frame': 244 obs. of 1 variable: $ names: Factor w/ 244 levels "ERA","BA
这就是问题: write a Java Program that accepts a String and an integer stretch factor P as parameters and
该示例显示了不同工厂的产量测量值,第一列表示工厂最后一列是生产量。 factory % mutate(factory=fct_lump(factory,2)) factory produc
我正在使用分类变量运行回归并遇到 this question .在这里,用户想要为每个虚拟对象添加一列。这让我很困惑,因为我虽然列有很长的数据,包括使用 as.factor() 存储的所有虚拟数据。相
假设在 R 中有一个 Data.Frame 对象,其中所有字符列都已转换为因子。然后我需要“修改”与数据帧中某一行相关联的值——但将其编码为一个因子。我首先需要提取一行,所以这就是我正在做的。这是一个
利用下面的可重现数据, dat head(dat) Bin Number 1 1 3 2 1 5 3 1 4 4 1 5 5 1
我有一组包含多个变量的数据。其中一个变量 - 阶乘包含组的名称 - A、B、C 等。其余变量是数字。 > data1 Group Value 1 A 23 2 A
我有一组编码为二项式的变量。 Pre VALUE_1 VALUE_2 VALUE_3 VALUE_4 VALUE_5 VALUE_6 VALUE_7 VALUE_8 1 1 0
我的问题与 this one 非常相似和 this other one ,但我的数据集有点不同,我似乎无法使这些解决方案起作用。如果我误解了什么并且这个问题是多余的,请原谅。 我有一个这样的数据集:
我一直在尝试生成一个带有离散 x 变量的堆积面积图(因为我想显示财政年度,即“2013/14”,而不是日历年)。但是,将 x 轴变量转换为一个因子会阻止在最终图表中呈现 geom。 有解决办法吗? l
只是一个简单的问题来确认我的想法, 使用负载因子 1.0 的哈希表的复杂性将是二次时间,用以下符号 O(n^2) 表示。 这是因为必须不断调整大小并一遍又一遍地插入。如果我错了,请纠正我。 谢谢 最佳
我正在尝试使用 kaggle 的一些数据集进行房价预测。 这是我的代码 library(ggplot2) dataset=read.csv('train(1).csv') dataset_test=r
我正在用 Angular 构建一个类似咆哮的 UI。我想将其公开为工厂(或服务),以使其在我的 Controller 中可用。调用 Growl.add 将导致 DOM 发生变化,所以看起来我应该有一个
我正在尝试将 pandas 数据框的一列转换为因数,因为我试图在 R 中调用的函数需要因数。 pandas2ri.activate() #second column of labels has
我正在尝试使用 plotly 绘制一个以字符串(组合数)作为 x 轴的条形图。 (“1”、“2”、“3”、“4 - 5”、“6 - 8”、“9 - 13”、“14 - 21”、“22 - 34”、“3
我有一个包含 NA 的数据集。 此外,它还有一些列需要factors()。 我正在使用 caret 包中的 rfe() 函数来选择变量。 似乎 rfe() 中的 functions= 参数使用 lmF
我有一个 .csv 文件,其中每个字段用于日期时间、日期和时间。 最初它们都是字符字段,我已经相应地转换了它们。 在我的代码结束时,如果我这样做: str(data) 我会得到 datetime: P
我有一个如下所示的数据集: data.flu data.flu chills runnyNose headache fever flu 1 1 0 M
我正在使用 QMainWindow 在 C++ 中手动布置 Qt 应用程序。我希望在屏幕底部有两个并排停靠的小部件,但我希望它们具有不成比例的宽度。目前,我只能让它们具有相同的宽度。有没有办法设置拉伸
我需要通过在两个主机(2 个 Java 进程)之间发送合成调用来计算 VOIP 质量。我应该找出 MOS、抖动和 R 因子(VOIP 质量指标)。根据目前的研究,我发现我应该在两台主机之间发送 RTP
我是一名优秀的程序员,十分优秀!