- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
我有一个 DataFrame,其中每行代表一次医生的就诊,每列包含来自一次诊断测试的数据。数据不完整,缺失值用 NaN 填充。
这是一个简化的示例:
AGE Height SEX Weight
0 79 40 Male 90
1 79 21 Male 20
2 79 NaN Male 50
3 79 89 Male NaN
4 79 90 Male 57
5 81 87 Female NaN
6 81 NaN Female 89
7 81 54 Female 79
8 81 21 Female NaN
9 81 23 Female 23
我想将每个 NaN 替换为相同性别和年龄患者的总体平均值。我已经能够创建一个 DataFrame,其中包含每个 AGE 和 SEX 组合的方法,如下所示:
age_sex_means = df.groupby(['SEX', 'AGE'])['Height','Weight'].mean()
这会产生以下数据帧:
Height Weight
SEX AGE
Female 81 37.0 38.2
Male 79 48.0 43.4
但是我找不到用第二个 DataFrame 中包含的方法替换第一个 DataFrame 中的 NaN 的方法。两者Using Pandas to fill NaN entries based on values in a different column, using a dictionary as a guide似乎解决了与我类似的情况,但只有一个索引显然不适用于我的具体情况。
最佳答案
选项 1
您可以将 apply
与 fillna
df.groupby(['AGE', 'SEX'], group_keys=False).apply(lambda x: x.fillna(x.mean()))
AGE Height SEX Weight
0 79 40.00 Male 90.000000
1 79 21.00 Male 20.000000
2 79 60.00 Male 50.000000
3 79 89.00 Male 54.250000
4 79 90.00 Male 57.000000
5 81 87.00 Female 63.666667
6 81 46.25 Female 89.000000
7 81 54.00 Female 79.000000
8 81 21.00 Female 63.666667
9 81 23.00 Female 23.000000
<小时/>
选项 2
使用 transform
和 combine_first
生成副本
df.combine_first(df.groupby(['SEX', 'AGE']).transform('mean'))
AGE Height SEX Weight
0 79 40.00 Male 90.000000
1 79 21.00 Male 20.000000
2 79 60.00 Male 50.000000
3 79 89.00 Male 54.250000
4 79 90.00 Male 57.000000
5 81 87.00 Female 63.666667
6 81 46.25 Female 89.000000
7 81 54.00 Female 79.000000
8 81 21.00 Female 63.666667
9 81 23.00 Female 23.000000
<小时/>
选项 3
与 fillna
df.fillna(df.groupby(['SEX', 'AGE']).transform('mean'))
AGE Height SEX Weight
0 79 40.00 Male 90.000000
1 79 21.00 Male 20.000000
2 79 60.00 Male 50.000000
3 79 89.00 Male 54.250000
4 79 90.00 Male 57.000000
5 81 87.00 Female 63.666667
6 81 46.25 Female 89.000000
7 81 54.00 Female 79.000000
8 81 21.00 Female 63.666667
9 81 23.00 Female 23.000000
<小时/>
选项 4
或者使用 update
就地编辑
df.update(df.groupby(['SEX', 'AGE']).transform('mean'))
df
AGE Height SEX Weight
0 79 40.00 Male 90.000000
1 79 21.00 Male 20.000000
2 79 60.00 Male 50.000000
3 79 89.00 Male 54.250000
4 79 90.00 Male 57.000000
5 81 87.00 Female 63.666667
6 81 46.25 Female 89.000000
7 81 54.00 Female 79.000000
8 81 21.00 Female 63.666667
9 81 23.00 Female 23.000000
关于python - 根据行条目替换 pandas DataFrame 中的 NaN,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/47244021/
首先我想说的是,我知道isNaN()和 Number.isNaN()工作。我正在阅读 David Flanagan 的 The Definite Guide,他举例说明了如何检查值是否为 NaN :
在表中,对于 skips day 列,最后一行的默认值始终是单词“last”,它不是数字。现在,结果日期显示为“NaN/NaN/NaN”,有什么方法可以将其替换为 Nil 之类的东西。 非常感谢。
我正在制作一个网站,如果用户登录,则会为用户提供一定的注销时间,其中定义了注销时间,剩余时间是从注销时间 - 服务器时间获得的。 我已经通过 PHP 获得了注销时间和服务器时间,但我想动态显示剩余时间
我有以下代码,它简单地初始化一个 UIImageView 以适应 UIImage 在当前屏幕尺寸上尽可能大的比例: CGSize mainScreenSize = [appDelegate mainS
这个问题已经有答案了: Why in numpy `nan == nan` is False while nan in [nan] is True? (1 个回答) 已关闭 3 年前。 我只是觉得这有
我有动态 JQGrid,其中一列是日期列。我从包含 URL 和日期的 feed 中获取数据。 我需要为“日期列”开发列模型,使其显示日期和超链接。但不幸的是,数据显示为 NAN/NAN/NAN (这可
我已经包含了一个演示我的问题的片段。基本上处理给了我这个错误: 调用map(NaN, -3, 3, -125, 125),返回NaN(不是数字) 我理解此消息的方式是,map 函数返回 NaN,并且由
我在下面创建的过滤器适用于 Chrome,但不适用于 Firefox。我不明白为什么。 myApp.filter('dateCustom', [ '$filter', function ($fil
虽然问题的第一部分(在标题中)之前已经回答过几次(即 Why is NaN not equal to NaN? ),但我不明白为什么第二部分会以它的方式工作(受此启发问题 How to Check l
我需要在数组中找到min和max值(不考虑可能的NaN值在这个数组中)。 这只使用 double 会很容易,但是这些 FindMin 和 FindMax 函数必须使用泛型类型。 我尝试以这种方式测
我正在开发一个屏幕,其中 UIScrollView 内只有一个 UIImageView。 UIScrollView 使用户能够固定和缩放图像。我从下面的帖子中得到了帮助。它使用 Storyboard和
尽管看到了类似的答案,但我不知道这里发生了什么。我制作了一个自定义的 UIImageview,它应该在创建后立即开始动画: class HeaderAnimator: UIImageView {
我正在寻找一个 pandas 系列并用下一个数值的平均值填充 NaN,其中:average = next numerical value/(# consecutive NaNs + 1) 到目前为止,
我有一个 mySql 表,其中有一个名为 posts 的列,该列设置为 timestamp 类型,默认为 current_timestamp。然后,我使用 php PDO 获取它的值(以及其他一些列)
我想知道以下类型的 nan 之间有什么区别。除了 NAN_macro (计算结果为 -nan(ind) 而不是 nan )的视觉差异外,它们的行为似乎都相同(根据下面的示例脚本)。 我看了一些其他的答
我为我的网页做了倒计时;它在除 Mozilla 和 IE 之外的所有浏览器上都能正常工作。 我做错了什么,我该如何解决? 下面是我的代码: ***var dt = '2018-06-14 11:59
在将 Xcode 更新到 8.3 后,我在启动时开始收到此错误:由于未捕获的异常“CALayerInvalidGeometry”而终止应用程序,原因:“CALayer 位置包含 NaN:[nan na
我正在使用 jquery 自动完成 onselect 它在不同的文本字段中显示数据。我使用 format_date() 函数在 #dob 和 #anniversery 中显示格式化日期 select:
我有一个带有 json Store 和 DateField 的网格。 Firefox 运行良好,但在 Internet Explorer 8 中无法运行。 我这样定义: function conver
我有一个错误,它在启动时使应用程序崩溃。这是我得到的错误: *** Terminating app due to uncaught exception 'CALayerInvalidGeometry'
我是一名优秀的程序员,十分优秀!