- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
我正在使用 python 实现一个狭窄且有限的脚本 DSL,我希望能够在功能上执行以下等效操作:
import numpy as np
a = np.arange(10)
a[ a > 5 ] += 42
=> array([ 0, 1, 2, 3, 4, 5, 48, 49, 50, 51])
上面的代码可以正常工作。如果我开始扩展上面的代码,我会得到以下第一层内部结构:
a[a>5].__iadd__(42)
这也按预期工作。但是,我找不到允许我在数组本身而不是数组副本上操作 __iadd__ 的索引器方法。因此,不出所料,以下代码无法满足我的要求:
import numpy as np
a = np.arange(10)
a.__getitem__(a>5).__iadd__(42)
=> array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9])
仅当我这样做时:
a.__setitem__(a>5, a.__getitem__(a>5).__iadd__(42))
我似乎得到了我正在寻找的行为,但在这一点上,这根本不再是一个合适的就地赋值运算符,更重要的是,我索引了两次(一次用于读取,一次用于写)。
Numpy 的索引 page似乎暗示高级索引(即下标列表是 ndarray 的索引)总是 返回一个副本。这是否真的意味着 a[a>5].__iadd__(42)
实际上总是使用回退方法实现的?有没有我遗漏的东西,或者这根本不可能,或者至少没有解释器魔法是不可能的?
编辑:
因此根据@donkopotamus 的回答,数据模型不允许我们一次完成此操作。 这回答了问题。
但是,numpy
作为一个矢量化库,索引绝对不能承受非矢量化和多次执行。
这是一个“证明”:
import cython
import numpy as np
@cython.locals(arr="float[:]",
mask="bint[:]",
val=float,
i=int)
@cython.boundscheck(False)
def func(arr,mask,val):
for i in range(len(mask)):
if mask[i]:
arr[i] += val
此代码在编译和计时时,比 numpy 慢:
a = np.arange(1e6)
%%timeit
a[a%3==0] += 42
=> 40.5 ms ± 376 µs per loop (mean ± std. dev. of 7 runs, 10 loops each)
a = np.arange(1e6)
%%timeit
func(a, (a%3==0), 42)
=> 116 ms ± 2.76 ms per loop (mean ± std. dev. of 7 runs, 1 loop each)
因此 REPL 解释语句比 3 行 cython 函数运行得更快,后者几乎可以像 CPU 允许的那样快地撕裂内存 View 。
在这个阶段,一切都不再有意义了。我知道 numpy 是手工制作的,用于优化矢量化操作,但我不了解它如何以有意义的方式与 python 解释器集成。它是否缓存 BINARY_SUBSCR/STORE_SUBSCR 对?
@donkopotamus 请注意,虽然索引操作不是计算 两次,但在 python 代码中,它是 解释 两次,因为对读取,然后对写入执行整个第二次扫描和掩码。在上面的 cython 代码中,该操作只发生一次读取和写入)。
欢迎任何见解。
最佳答案
您面临的问题不是特定于 numpy
本身,也不是 numpy
中的高级索引,也不是它是否创建副本。相反,它完全是由围绕是否:
索引保证返回容器“内部”的值(实际上不是);以及是否
就地添加保证返回原始值的修改版本(不是)
考虑表达式:
x[a] += 100
其中 x
是一个列表 say。 x[a]
的结果是一个值 y
,它不知道它恰好包含在列表中,表达式 y += 100
不能保证修改 y
的原始值...因此我们永远不能确保 x.__getitem__(x).__iadd__(100)< 形式的表达式
影响原始的 x
。
因此表达式 x[a] += 100
必须由编译器使用以下步骤计算:
y = x[a]
y += 100
x[a] = y
或者在高级索引的情况下,我们可以期望 a[ a > 5 ] += 42
实现为:
b = a > 5
c = a[b]
c += 42
a[b] = c
这可以通过查看示例函数的反汇编来证明
def f(a):
a[a > 5] += 42
然后
>>> dis.dis(f)
0 LOAD_FAST 0 (a)
2 LOAD_FAST 0 (a)
4 LOAD_CONST 1 (5)
6 COMPARE_OP 4 (>) # 1. b = a > 5
8 DUP_TOP_TWO
10 BINARY_SUBSCR # 2. c = a[b]
12 LOAD_CONST 2 (42)
14 INPLACE_ADD # 3. c += 42
16 ROT_THREE
18 STORE_SUBSCR # 4. a[b] = c
20 LOAD_CONST 0 (None)
22 RETURN_VALUE
请注意,在此实现中,索引 a > 5
不会执行两次。但是,如果您必须作为一组链式方法来实现,那么您别无选择,只能按照您的建议实现。
关于python - 如何仅使用数据模型 dunder 方法执行(高级)索引就地(增强)分配给 numpy 向量?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/58657486/
我有一个“有趣”的问题,即以两种不同的方式运行 wine 会导致: $> wine --version /Applications/Wine.app/Contents/Resources/bin/wi
我制作了这个网络抓取工具来获取网页中的表格。我使用 puppeteer (不知道 crontab 有问题)、Python 进行清理并处理数据库的输出 但令我惊讶的是,当我执行它时 */50 * * *
JavaScript 是否被调用或执行取决于什么?准确地说,我有两个函数,它们都以相同的方式调用: [self.mapView stringByEvaluatingJavaScriptFromStri
我目前正在使用 python 做一个机器学习项目(这里是初学者,从头开始学习一切)。 只是想知道 statsmodels 的 OLS 和 scikit 的 PooledOlS 使用我拥有的相同面板数据
在使用集成对象模型 (IOM) 后,我可以执行 SAS 代码并将 SAS 数据集读入 .Net/C# 数据集 here . 只是好奇,使用 .Net 作为 SAS 服务器的客户端与使用 Enterpr
有一些直接的 jQuery 在单击时隐藏打开的 div 未显示,但仍将高度添加到导航中以使其看起来好像要掉下来了。 这个脚本工作正常: $(document).ready(funct
这个问题已经有答案了: How do I compare strings in Java? (23 个回答) 已关闭 4 年前。 这里是 Java 新手,我正在使用 NetBeans 尝试一些简单的代
如果我将它切换到 Python 2.x,它执行 10。这是为什么? 训练逻辑回归模型 import keras.backend as
我有两个脚本,它们包含在 HTML 正文中。在第一个脚本中,我初始化一个 JS 对象,该对象在第二个脚本标记中引用。 ... obj.a = 1000; obj.
每当我运行该方法时,我都会收到一个带有数字的错误 以下是我的代码。 public String getAccount() { String s = "Listing the accounts";
我已经用 do~while(true) 创建了我的菜单;但是每次用户输入一个数字时,它不会运行程序,而是再次显示菜单!你怎么看? //我的主要方法 public static void main(St
执行命令后,如何让IPython通知我?我可以使用铃声/警报还是通过弹出窗口获取它?我正在OS X 10.8.5的iTerm上运行Anaconda。 最佳答案 使用最新版本的iTerm,您可以在she
您好,我刚刚使用菜单栏为 Swing 编写了代码。但是问题出现在运行中。我输入: javac Menu.java java Menu 它没有给出任何错误,但 GUI 没有显示。这是我的源代码以供引用:
我觉得这里缺少明显的东西,但是我看不到它写在任何地方。 我使用Authenticode证书对可执行文件进行签名,但是当我开始学习有关它的更多信息时,我对原样的值(value)提出了质疑。 签名的exe
我正在设计一个应用程序,它使用 DataTables 中的预定义库来创建数据表。我想对数据表执行删除操作,为此应在按钮单击事件上执行 java 脚本。 $(document).ready(functi
我是 Haskell 新手,如果有人愿意帮助我,我会很高兴!我试图让这个程序与 do while 循环一起工作。 第二个 getLine 命令的结果被放入变量 goGlenn 中,如果 goGlenn
我有一个用 swing 实现迷你游戏的程序,在主类中我有一个循环,用于监听游戏 map 中的 boolean 值。使用 while 实现的循环不会执行一条指令,如果它是唯一的一条指令,我不知道为什么。
我正在尝试开发一个连接到 Oracle 数据库并执行函数的 Java 应用程序。如果我在 Eclipse 中运行该应用程序,它可以工作,但是当我尝试在 Windows 命令提示符中运行 .jar 时,
我正在阅读有关 Java 中的 Future 和 javascript 中的 Promises 的内容。下面是我作为示例编写的代码。我的问题是分配给 future 的任务什么时候开始执行? 当如下行创
我有一个常见的情况,您有两个变量(xSpeed 和 ySpeed),当它们低于 minSpeed 时,我想将它们独立设置为零,并在它们都为零时退出。 最有效的方法是什么?目前我有两种方法(方法2更干净
我是一名优秀的程序员,十分优秀!