python - 使用 .fillNA() 填充数据，数据来自 Quandl-6ren

python - 使用 .fillNA() 填充数据，数据来自 Quandl

转载作者：太空宇宙更新时间：2023-11-04 03:18:29

25

4

我从 Quandl 提取了一些原油价格 (WTI) 和卡特彼勒 (CAT) 价格的股票数据。当我将两个数据帧连接在一起时，我留下了一些 NaN。我的最终目标是运行 .Pearsonr() 来评估相关性(连同 p 值)，但是由于所有的 Nan，我无法让 Pearsonr() 工作。所以我想清理它们。当我使用 .fillNA() 函数时，它似乎不起作用。我什至尝试过 .interpolate() 和 .dropna()。它们似乎都不起作用。这是我的工作代码。

import Quandl
import pandas as pd
import numpy as np


#WTI Data#
WTI_daily = Quandl.get("DOE/RWTC", collapse="daily",trim_start="1986-10-10", trim_end="1986-10-15")
WTI_daily.columns = ['WTI']

#CAT Data
CAT_daily = Quandl.get("YAHOO/CAT.6", collapse = "daily",trim_start="1986-10-10", trim_end="1986-10-15")
CAT_daily.columns = ['CAT']  

#Combine Data Frames
daily_price_df = pd.concat([CAT_daily, WTI_daily], axis=1)
print daily_price_df

#Verify they are dataFrames:
def really_a_df(var):
    if isinstance(var, pd.DataFrame):
        print "DATAFRAME SUCCESS"
    else:
        print "Wahh Wahh"
    return 'done'

print really_a_df(daily_price_df)

#Fill NAs 
#CAN'T GET THIS TO WORK!!
daily_price_df.fillna(method='pad', limit=8)
print daily_price_df

# Try to interpolate
#CAN'T GET THIS TO WORK!!
daily_price_df.interpolate()
print daily_price_df

#Drop NAs
#CAN'T GET THIS TO WORK!!
daily_price_df.dropna(axis=1)
print daily_price_df

当我使用这段代码从头开始创建数据框时，我已经设法使该功能正常工作，这是值得的:

import pandas as pd
import numpy as np

d = {'a' : 0., 'b' : 1., 'c' : 2.,'d':None,'e':6}
d_series = pd.Series(d, index=['a', 'b', 'c', 'd','e'])
d_df =  pd.DataFrame(d_series)
d_df = d_df.fillna(method='pad')

print d_df

最初我在想，也许我的数据不是数据框形式，但我使用了一个简单的测试来确认它们实际上是数据框。我留下的唯一结论(在我看来)是它与 Quandl 数据帧的结构有关，或者可能与 TimeSeries 性质有关。请知道我对 python 有点陌生，所以为初学者/新手构建答案。非常感谢任何帮助!

最佳答案

pot shot - 你是不是忘了分配或使用 inplace 标志。

daily_price_df = daily_price_df.fillna(method='pad', limit=8)
OR
daily_price_df.fillna(method='pad', limit=8, inplace=True)

关于python - 使用 .fillNA() 填充数据，数据来自 Quandl，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/35461548/

25

4

0

文章推荐： css - 使用 less 更改屏幕大小时更改字体大小

文章推荐： python - 导入caffe时出错

文章推荐： html - Vaadin:强制 CSS 容器在动画后适应全宽

文章推荐： Node.js - process.exit() 与 childProcess.kill()

python - Fillna 如果出现频率最高，则 fillna 为整个列中出现频率最高的值
我有一个 Pandas 数据框 City State 0 Cambridge MA 1 NaN DC 2 Boston MA
python - 如何用列名替换类别的 fillna？
我有一个 pandas 数据框，我想用 'colname_miss' 字符串填充缺失的类别。 def FillCatMissing(df): cols = ['A','B','C']
python - 每列中的变量 fillna()
对于初学者，这里有一些符合我的问题的人工数据: df = pd.DataFrame(np.random.randint(0, 100, size=(vsize, 10)), col
python - fillna 可以接受一个函数还是只接受给定的方法？
fillna可以接受一个函数吗？或者只是“backfill”、“bfill”等方法？ http://pandas.pydata.org/pandas-docs/stable/generated/pan
python - 如何在分组数据框上使用 fillna？
我想在多索引数据帧上使用 fillna，并仅在特定列位于同一索引中时填充该列。下一个索引可能以 n/a 开头，因此我无法在该列上调用 fillna 。组的大小正在变化，因此我无法通过数量来限制功能。
python - fillna 没有给出预期的结果
我正在尝试替换 pandas 数据框中的 NaT。 orders.PAID_AT 0 NaT 1 NaT 2
Python Pandas fillna()
我有一个大型数据框，其值如下: Name A B C D E F G # Coulmns Matt 1 n n n 5 n 5 # rows Jake n n 2
python - 我如何使用类别中值进行 df.fillna
我有一个大约 100 万行的大型数据集，大约有 5000 个缺失坐标(我想用类别“城市”的中值填充它们，但 fillna 正在工作，如何实现它？ city = ['London', 'Paris',
pandas - 如何使用条件执行 pd.fillna()
我正在尝试用 if 条件做一个 fillna Fimport pandas as pd df = pd.DataFrame(data={'a':[1,None,3,None],'b':[4,None,
python - pandas fillna 按顺序一步一步
我有如下数据框 Re_MC,Fi_MC,Fin_id,Res_id, 1,2,3,4 ,7,6,11 11,,31,32 ,,35,38 df1 = pd.read_clipboard(sep
python - 带有递增值的 Pandas fillna
我有一个数据框，其中有一列连续但不相邻的数字和缺失值。我想使用 fillna 函数用前一个非缺失行的增量值填充缺失值。这是一个简化的表格: index my_counter 0 1 1
python - pandas 数据框中的条件 fillna()
我有以下两个数据框 df1和 df2df1: A B C D 1 Nora NaN Japan 2 Neo NaN India 3
python - Pandas fillna 和滚动平均值
我试图填充所有缺失值，直到数据帧结束，但无法这样做。在下面的示例中，我取了最后三个值的平均值。我的代码只填充到 2017-01-10，而我想填充到 2017-01-14。对于 1/14，我想使用 11
python - 最近日期的 Pandas fillna
我有一个关于给定主题的报告数据框。每份报告都有一个分数，受试者在某些日期有分数，但在其他日期没有分数。我想创建一个新的数据框，它只包含每个主题的最新分数。下面是一个 MRE。原始数据框如下所示:
python - Fillna 一次使用多种方法 - pandas
我有一个如下所示的数据框 df = pd.DataFrame({'person_id': [101,101,101,101,202,202,202],
python - 为什么 fillna 不能按预期模式工作
我正在处理一个汽车销售数据集，其中包含以下列:'car'、'price'、'body'、'mileage'、'engV'、'engType'、'registration'、'year'、'model'
python - pandas fillna 不适用于数据集的子集
我想估算 df['box_office_revenue'] 的缺失值中位数由 df['release_date'] == x 指定和df['genre'] == y 。下面是我的中值查找函数。 de
python - Pandas fillna 到空字典
我有一个带有“元数据”列的 Pandas 数据框，该列应包含字典作为值。但是，某些值丢失并设置为 NaN。我希望这是 {}。有时，整个列都丢失了，将其初始化为 {} 也是有问题的。用于添加列 tsp
python - Pandas - 具有行子集的 fillna
我正在尝试在特定条件适用的情况下用 0 填充某些行。我正在尝试: df.loc[:,(df.Available == True) & (df.Intensity.isnull())].Intensit
python - 多索引系列上的 Pandas fillna
带有 NA 的 series_A 由一个 MultiIndex (X, Y) 索引，而要填写的值在 Series_B 中，它由 X 索引。如何有效解决此类问题？例如，这里是series_A: bar

首页

博学

6Ren·AI

商城

python - 使用 .fillNA() 填充数据，数据来自 Quandl