- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
我有一个名为 df
的数据框,格式如下:
match_up result
0 1985_1116_1234 1
1 1985_1120_1345 1
2 1985_1207_1250 1
3 1985_1229_1425 1
我有另一个名为 df1
的数据框
team win percentage sum_of_last_six seed_frequency
0 1116 0.700 5 7
1 1234 0.667 3 10
2 1120 0.636 4 9
3 1207 0.615 2 11
4 1229 0.345 2 3
5 1345 0.621 5 11
6 1425 0.572 1 2
7 1250 0.968 4 12
我需要以 df2
包含所有左侧值(成功1985 年之后_) 数据框 df
中的列 matchup
即。 1116、1120、1207、1229
。 df3
的值应位于 matchup
列的右侧。
team_df2 win_df2 sum_df2 seed_df2
0 1116 0.700 5 7
1 1120 0.636 4 9
2 1207 0.615 2 11
3 1229 0.345 2 3
team_df3 win_df3 sum_df3 seed_df3
1 1234 0.667 3 10
5 1345 0.621 5 11
7 1250 0.968 4 12
6 1425 0.572 1 2
最后我需要一个结合了三个数据框(df
、df2
和df3
)的新数据框
我需要按照以下格式形成一个名为 combi
的新数据框:
match_up result team_df2 win_df2 sum_df2 seed_df2
0 1985_1116_1234 1 1116 0.700 5 7
1 1985_1120_1345 1 1120 0.636 4 9
2 1985_1207_1250 1 1207 0.615 2 11
3 1985_1229_1425 1 1229 0.345 2 3
team_df3 win_df3 sum_df3 seed_df3
1234 0.667 3 10
1345 0.621 5 11
1250 0.968 4 12
1425 0.572 1 2
我如何在 pandas 中执行此操作?
最佳答案
您可以调用 'match_up' 列上的矢量化 str
方法来拆分字符串,将它们映射到 int 并创建一个列表,以便我们可以过滤第二个 df 以创建 df2 和 df3:
In [90]:
left = list(map(int,(df['match_up'].str.split('_').str[1])))
right = list(map(int,(df['match_up'].str.split('_').str[2])))
print(left)
right
[1116, 1120, 1207, 1229]
Out[90]:
[1234, 1345, 1250, 1425]
In [91]:
df2 = df1[df1.win.isin(left)]
df2
Out[91]:
team win percentage sum_of_last_six seed_frequency
0 0 1116 0.700 5 7
2 2 1120 0.636 4 9
3 3 1207 0.615 2 11
4 4 1229 0.345 2 3
In [92]:
df3 = df1[df1.win.isin(right)]
df3
Out[92]:
team win percentage sum_of_last_six seed_frequency
1 1 1234 0.667 3 10
5 5 1345 0.621 5 11
6 6 1425 0.572 1 2
7 7 1250 0.968 4 12
如果需要,您可以重命名调用rename
的列。
要使用重命名的列获得所需的合并输出 df:
In [95]:
df2 = df2.rename(columns={'team':'team_df2', 'win':'win_df2', 'sum_of_last_six':'sum_df2', 'seed_frequency':'seed_df2'})
df3 = df3.rename(columns={'team':'team_df3', 'win':'win_df3', 'sum_of_last_six':'sum_df3', 'seed_frequency':'seed_df3'})
In [101]:
pd.concat([df,df2,df3],axis=1)
Out[101]:
match_up result team_df2 win_df2 percentage sum_df2 seed_df2 \
0 1985_1116_1234 1 0 1116 0.700 5 7
1 1985_1120_1345 1 NaN NaN NaN NaN NaN
2 1985_1207_1250 1 2 1120 0.636 4 9
3 1985_1229_1425 1 3 1207 0.615 2 11
4 NaN NaN 4 1229 0.345 2 3
5 NaN NaN NaN NaN NaN NaN NaN
6 NaN NaN NaN NaN NaN NaN NaN
7 NaN NaN NaN NaN NaN NaN NaN
team_df3 win_df3 percentage sum_df3 seed_df3
0 NaN NaN NaN NaN NaN
1 1 1234 0.667 3 10
2 NaN NaN NaN NaN NaN
3 NaN NaN NaN NaN NaN
4 NaN NaN NaN NaN NaN
5 5 1345 0.621 5 11
6 6 1425 0.572 1 2
7 7 1250 0.968 4 12
关于python - 如何在 Pandas 中组合和形成复杂的数据框,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/28967654/
我之前发布过question已得到答复,但我也需要对此进行查询。我有一个包含这样数据的表结构(日期格式为 dd/mm/yyyy)。 ID Account Number Unit Ad
我正在使用 React Native Calendars 并尝试为议程组件构建我的数据。 预期的数据结构是(一个对象) { '2012-05-22': [{text: 'item 1 - any j
这个问题不太可能对任何 future 的访客有帮助;它只与一个较小的地理区域、一个特定的时间点或一个非常狭窄的情况相关,通常不适用于全世界的互联网受众。如需帮助使此问题更广泛适用,visit the
两列城镇和优先级。 我需要对表进行排序,以便优先级=1的城镇排在第一位,并且不按名称 ASC 排序,而其余城镇则按名称 ASC 排序。 我该怎么做? 谢谢;) 更新 SELECT * FROM map
我有三个表“Hardware_model”、“Warehouse”和“Brand”,并且表以这种方式一起引用:Hardware_model 仓库Hardware_model 品牌 现在我要执行以下
我有一个 MySQL 表 (tbl_filters),包含 3 列:id、cat、val id 和 val 是数字,cat 是 varchar。每个 id 有多行。 我还有另一个包含多个列的表 (tb
我想获取字段的不同值,比方说:field1...这需要一个如下查询:“从表中选择不同的(字段1)” 但是,对于某些记录,field1 为空,并且还有另一列可以替代 field1,即 field2。对于
表 1 - 用户 id username items 1 Paul 1(0020);2(0001); 表 2 - 项目 id name 1 name_here 在我的用户的项目中,我输入了 2(000
我想连接同一个表 4 次以获取列的显示方式,我不确定是否可以在 1 个 SQL 语句中完成。 tbl_用户名 id username 1 Adam 2 Bob 3 Chris tbl_机
首先,我刚刚开始自己学习JS,没有任何编程经验,这意味着我仍然要了解这种出色的编程语言的基本构建模块。 我的问题与我编写的以下代码有关: let orderCount = 0; con
关闭。这个问题需要details or clarity .它目前不接受答案。 想改进这个问题吗? 通过 editing this post 添加细节并澄清问题. 关闭 9 年前。 Improve t
我正在使用 XMAPP,MySQL 正在正常运行。在 phpMyAdmin 中,我不太明白这一点,所以我尝试在 PHP 中创建一个。使用此代码,它会告诉我数据库 benutzer。尽管我在 phpMy
是否有一种高效的算法可以找到平均度最大的子图(可能是图本身)? 最佳答案 The paper "Finding a Maximum-Density Subgraph" by Andrew Goldbe
目录 1、业务背景 2、场景分析 3、流程设计 1、业务流程 2、导入流程
我有 2 个表: 1) 包含自 1900 年 1 月 1 日以来所有日期的 Masterdates 表 2) Stockdata 表,其中包含表单中的股票数据 日期、交易品种、开盘价、最高价、最低价、
我有一个非常复杂的 UI,其状态栏不断变化,其中包含多种类型的状态消息,并且 UI 具有复杂的图表控件和已加载的指示性地理 map 。 现在这些小而复杂的区域的数据上下文具有同样复杂的 ViewMod
有人可以用简单的方式向我解释为什么常量在大 O 表示法中无关紧要吗?为什么添加常量时复杂性保持不变。这不是作业问题,我只是想更好地理解这一点。让我明白这个大 O 是为了看到一个函数在接近无穷大时的行为
我在 flex 搜索索引中有以下文档。 [{ "_index": "ten2", "_type": "documents", "_id": "c323c
我有一个以零碎的方式构建的 LINQ 查询,如下所示: var initialQuery = from item in MyContext where xxx == yyy select item;
我目前正在涉足 SQL,并且希望针对我所创建的问题获得一些帮助。 为了练习一些编程,我正在制作一个 IOU 应用程序。下面是我存储的表我的借条记录(忽略一些相关栏目)。该表允许用户说“嘿,你欠我 X
我是一名优秀的程序员,十分优秀!