- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在使用 from sklearn.preprocessing import MinMaxScaler
使用以下代码和数据集:
df = pd.DataFrame({
"A" : [-0.5624105,
-0.5637749,
0.2973856,
0.619784,
0.007297921,
0.8146919,
0.1082434,
-0.2311236,
-0.6945567,
-0.6807524,
-0.1017431,
0.5889628,
0.5384794,
0.3906553,
0.3843442,
0.4408366,
0.4035791,
0.05258237,
-0.4847771
],
"B" : [-0.5068743,
0.1422121,
0.6444226,
0.4959088,
-0.2260773,
0.3420533,
0.2346546,
0.1177824,
-0.7701161,
-0.7566853,
-0.5091485,
0.4509938,
0.4209853,
0.304058,
0.3753832,
0.6958977,
0.6763205,
0.05536954,
-0.9857719
]})
min_max_scaler = MinMaxScaler(feature_range=(0,255))
print(df)
df[df.columns] = min_max_scaler.fit_transform(df[df.columns])
print(df)
print(type(df))
我想用整个数据集中的最小值和整个数据集中的最大值来缩放它我如何使用相同的代码管理它?是否可以?
A B
0 -0.562411 -0.506874
1 -0.563775 0.142212
2 0.297386 0.644423
3 0.619784 0.495909
4 0.007298 -0.226077
5 0.814692 0.342053
6 0.108243 0.234655
7 -0.231124 0.117782
8 -0.694557 -0.770116
9 -0.680752 -0.756685
10 -0.101743 -0.509149
11 0.588963 0.450994
12 0.538479 0.420985
13 0.390655 0.304058
14 0.384344 0.375383
15 0.440837 0.695898
16 0.403579 0.676320
17 0.052582 0.055370
18 -0.484777 -0.985772
A B
0 22.327190 72.617646
1 22.096664 171.041874
2 167.596834 247.194572
3 222.068703 224.674680
4 118.584127 115.196304
5 255.000000 201.344798
6 135.639699 185.059394
7 78.300845 167.337476
8 0.000000 32.700971
9 2.332350 34.737551
10 100.160748 72.272798
11 216.861207 217.863993
12 208.331620 213.313653
13 183.355519 195.583380
14 182.289206 206.398778
15 191.834063 255.000000
16 185.539101 252.031411
17 126.235309 157.873501
18 35.443994 0.000000
我不希望每一列都有不同的映射,我需要使用 -0.985772 0.814692(b 列第 18 行,a 列第 5 行)来映射它
最佳答案
您有两种方法可以做到这一点:
# Manually:
min_value, max_value = df.min().min(), df.max().max()
scaled1 = (df - min_value) * 255 / (max_value - min_value)
# Using MinMaxScaler
min_max_scaler = MinMaxScaler(feature_range=(0,255))
# Stack everything into a single column to scale by the global min / max
tmp = df.to_numpy().reshape(-1,1)
scaled2 = min_max_scaler.fit_transform(tmp).reshape(len(df), 2)
两者都返回相同的结果:
np.isclose(scaled1, scaled2).all()
# True
您可以使用缩放值创建一个新的 DataFrame:
scaled = pd.DataFrame(scaled1, index=df.index, columns=df.columns)
或者将它们分配回
df
:
df.loc[:] = scaled1
关于python - 整个数据帧python的最小最大缩放,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/63463531/
“用 Haskell 进行函数式思考”中的练习之一是使用融合定律使程序更加高效。我在尝试复制答案时遇到了一些麻烦。 部分计算要求您将 maximum (xs++ map (x+) xs) 转换为 ma
我正在尝试获得 R 中最大/最小的可表示数字。 输入“.Machine”后 我有: $double.xmin [1] 2.225074e-308 $double.xmax [1] 1.797693e+
有没有办法更改浏览器验证消息 请检查所附图片。 我目前正在使用 wooCommerce 目前它显示小于或等于 X 个数字,我想更改为请求超过 X 个项目的报价。 请多多指教 最佳答案 您需要使用oni
我正在尝试将解决方案从 Excel 求解器复制到 R 中,但不知道从哪里开始。 问题: 每小时选择 5 个选项(5 行),以最大化“分数”的总和,而无需在多个小时内选择同一组 2 次。 换句话说: 最
Haskell 中是否有这样的功能: max_of_type :: (Num a) => a 所以: max_of_type :: Int == 2 ^ 31 - 1 // for example,
我有这两个表示时间范围(秒)的输入字段,我需要这样设置,以便“from/min”字段不能高于“to/max”,反之亦然。 到目前为止我得到了这个: jQuery(document).ready(fun
我有一个看起来像这样的表: http://sqlfiddle.com/#!9/152d2/1/0 CREATE TABLE Table1 ( id int, value decimal(10,
我会尝试尽可能简单地解释它: 首先是一些带有虚拟数据的数据库结构。 结构 tb_spec_fk feature value ----------------- 1 1 1
我有两个表。 表 1: +---------+---------+ | Lead_ID | Deal_ID | +---------+---------+ | 2323 | null |
我的数据库中有一个字段可以包含数字,例如8.00 或范围编号,例如8.00 - 10.00。 如果您将每个数字作为单独的数字,我需要从表中获取 MIN() 和 MAX()。例如当范围为 8.00 -
max(float('nan'), 1) 计算结果为 nan max(1, float('nan')) 计算结果为 1 这是预期的行为吗? 感谢您的回答。 max 在 iterable 为空时引发异常
我想问一下如何在 CSS 中创建一个页脚栏,它具有最小宽度(比如 650 像素),并且会根据窗口大小进行拉伸(stretch),但仅限于某个点(比如 1024 像素)。 我的意思是当窗口大小为例如 1
我尝试调整表格列宽(下一个链接上的“作者”列 http://deploy.jtalks.org/jcommune/branches/1?lang=en)。我已将最小/最大属性添加到 .author-c
在 C# 中,是否有用于将最小值和最大值存储为 double 值的内置类? 此处列出的要点 http://msdn.microsoft.com/en-us/library/system.windows
问题: 每个任务队列是否可以每秒处理超过 500 个任务? 每个 GAE 应用是否可以每秒处理超过 50,000 个任务? 详细信息: Task queue quota文档说: Push Queue
我想知道是否允许最大或最小堆树具有重复值?我试图仅通过在线资源查找与此相关的信息,但一直没有成功。 最佳答案 是的,他们可以。您可以在“算法简介”(Charles E. Leiserson、Cliff
首先,我是 .NET 开发人员,喜欢 C# 中的 LINQ 和扩展方法。 但是当我编写脚本时,我需要相当于 Enumerable extension methods 的东西 任何人都可以给我任何建议/
这是一个检查最大 malloc 大小的简单程序: #include std::size_t maxDataSize = 2097152000; //2000mb void MallocTest(vo
我想找到我的数据的最小值和最大值。 我的数据文件: 1 2 4 5 -3 -13 112 -3 55 42 42 而我的脚本: {min=max=$1} {if ($1max) {max=$1}
我想查询我的Elastic-Search以获取仅具有正值的最低价格价格。我的价格也可以为零和-1;所以我不希望我的最小聚合返回0或-1。我知道我应该向查询(或过滤器)添加脚本,但是我不知道如何。我当前
我是一名优秀的程序员,十分优秀!