- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
Python 新手,这是我需要帮助的最新挑战
在 df1 中,我有以下数据分布:
data = {'Code': ['53.110.30.0140.','53.110.30.0200.','53.110.30.0240. ','53.110.3130.','53.110.3140.'],
'AA': ['53','53','53','53','53'],
'BBB': ['110','110','110','110','110'],
'CC': ['30','30','30','31','31'],
'DDDD': ['0140','0200','0240','0030','0040']}
df1 = pd.DataFrame(data, columns=['Code','AA','BBB','CC','DDDD'])
在 df2 中,我有以下数据分布:
data2 = {'Size': ['0005','0007','0010','0015','0020','0030','0040','0060','0080','0100','0120','0140','0160','0180','0200','0220','0240'],
'10': [3,5,2,35,47,19,5,14,27,25,46,18,46,38,17,17,23],
'31': [48,11,26,4,28,25, 19,42,33,41,25,37,35,5,2,27,29],
'41': [1,32,38,12,15,39,6,46,5,36,35,25,13,12,50,19,19],
'20': [6,10,7,4,47,25,20,44,20,31,9,44,26,17,20,33,39],
'21': [21,31,44,12,18,40,8,4,18,32,34,40,29,10,6,14,22],
'30': [34,50,3,32,8,31,35,40,30,16,37,11,39,16,12,36,22],
'32': [41,25,32,11,35,18,49,12,31,4,24,8,14,29,28,12,7],
'40': [48,42,9,11,8,10,39,50,40,46,10,9,42,33,24,7,48],
'42': [20,21,21,3,23,50,8,41,7,14,14,5,19,9,13,41,48],
'50': [11,22,24,15,29,46,10,39,46,38,14,13,24,8,14,22,35],
'51': [41,47,18,26,34,4,19,7,36,13,27,20,21,49,46,30,16],
'60': [1,1,13,12,1,18,26,7,21,45,5,18,13,4,50,16,15],
'61': [10,18,24,12,25,48,19,32,5,40,37,8,32,14,15,1,20],
'62': [34,34,8,21,8,25,7,10,38,16,32,49,21,31,28,13,41]}
df2 = pd.DataFrame(data2, columns=['Size','10','31','41','20','21','30','32','40','42','50','51','60','61','62'])
我想要实现的是在 df1 中添加一个名为“值”的列,其中包含 df2 中满足以下两个匹配条件的值(换句话说,它们相交的地方就是我需要的值)
如前所述,所需的结果将返回相交值,例如,如果 df1['DDDD'] = '0140' 和 df1['CC'] = '30',则 df2 返回的值应等于 ' 11'。
我尝试过使用合并和映射,但由于我的列名不匹配而遇到了困难
希望我已经解释清楚了。
提前致谢!
最佳答案
看起来像一个lookup
作业:
df2.set_index('Size', inplace=True)
df1['Out'] = df2.lookup(df1['DDDD'], df1['CC'])
输出:
Code AA BBB CC DDDD Out
0 53.110.30.0140. 53 110 30 0140 11
1 53.110.30.0200. 53 110 30 0200 12
2 53.110.30.0240. 53 110 30 0240 22
3 53.110.3130. 53 110 31 0030 25
4 53.110.3140. 53 110 31 0040 19
关于python - 根据 df1 中的列值查找 df2 中的相交值,并在 df1 中创建一个具有检索值的新列(不匹配的列名),我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/65151212/
努力理解标题中 5 个示例之间的区别。系列与数据框有一些用例吗?什么时候应该使用一个而不是另一个?哪些是等价的? 最佳答案 df[x] — 使用变量 x 索引列。返回 pd.Series df[[x]
在使用Jupyter Notebook时,我必须为问题标题中提到的df.info()、df.head()等单独留出空格. 有没有办法像第二张图片那样把所有这些都放在一个 block 中,并显示所有信息
我想求三列之和,我采取的方法如下: In [14]: a_pd = pd.DataFrame({'a': np.arange(3), 'b': [5, 7,
我想我们大多数人已经使用过这样的东西(至少如果你正在使用 tidyverse): library(tidyverse) example % select(- mpg) 我的问题: 我知道这部分有一
我有一个 DF,里面有大约 20,000 行。我构建了一个 Python 脚本来对这些数据(包括数据透视表)运行大量清理和数学运算。 我想将此 DF 拆分为 3 个独立的 DF,然后根据列值将这 3
我什至不知道如何表达这一点,但在 Python 中有没有一种方法可以引用等号之前的文本,而无需实际再次编写? ** 编辑 - 我在 Jupyter 中使用 python3 我似乎用了半辈子的时间来写作
在 df1 中,每个单元格值都是我想要从 df2 中获取的行的索引。 我想获取 df2 trial_ms 列中行的信息,然后根据获取的 df2 列重命名 df1 中的列。 可重现的 DF: # df1
我想转换此表 0 thg John 3.0 1 thg James 4.0 2 mol NaN 5.0 3 mol NaN NaN 4
我有一个数据框,我想从中提取 val 中的值大于 15 以及 val 不是 NA: df[ !is.na(df$val) & df$val > 15, ] 由于我假设在 R 中经常需要这样的比较,所
鉴于 coming deprecation of df.ix[...] 如何替换这段代码中的 .ix? df_1 = df.ix[:, :datetime.time(16, 50)] d
任何我可以帮助我说出 Pandas 中这两个语句之间的区别-python df.where(df['colname'] == value) 和 df[(df['colname'] == value)]
考虑 df Index A B C 0 20161001 0 24.5 1 20161001 3 26.5 2
所以我需要按“fh_status”列对行进行分组,然后对每个组执行“gini”的最小值、平均值和最大值(将有三个)。我想出了这段代码: m = (df2.groupby(['fh_status']).
我尝试计算不同公司/股票的一些 KPI。我的股票信息位于 df 中,具有以下结构 Ticker Open High Low Ad
我有一个看起来像这样的 df: gene ID Probe ID Chromosome Start Stop 1: H3F3A 539154271
nn_idx_df 包含与 xyz_df 的索引匹配的索引值。如何从 xyz_df 中的 H 列获取值并在 nn_idx_df 中创建新列以匹配 output_df 中所示的结果。我可以解决这个问题,
我目前的 DF 看起来像这样 Combinations Count 1 ('IDLY', 'VADA') 3734 6 ('DOSA', 'IDLY')
我看到了几个与此相关的问题,但我发现这些技巧都不起作用。 我正在尝试根据第二个数据帧的值填充数据帧的所有 NaN 值。第一个 df 很大,第二个 df 将充当某种键。 DF1 Par
我有两个数据帧,df1 和 df2。每个数据帧的唯一标识符是“ID”和“Prop_Number”。我需要将 df1 中的 Num1、2 和 3 列复制到 df2、1_Num 中的相应列...但我不确定
我有以下数据框: 注意:日期是索引 city morning afternoon evening midnight date 2014-05-01 Y
我是一名优秀的程序员,十分优秀!