- c - 在位数组中找到第一个零
- linux - Unix 显示有关匹配两种模式之一的文件的信息
- 正则表达式替换多个文件
- linux - 隐藏来自 xtrace 的命令
我正在寻找一种将 numpy 数组分割成重叠 block 的有效方法。我知道 numpy.lib.stride_tricks.as_strided
可能是要走的路,但我似乎无法理解它在适用于任意形状数组的通用函数中的用法。 Here are some examples for specific applications of as_strided
.
这是我想要的:
import numpy as np
from numpy.lib.stride_tricks import as_strided
def segment(arr, axis, new_len, step=1, new_axis=None):
""" Segment an array along some axis.
Parameters
----------
arr : array-like
The input array.
axis : int
The axis along which to segment.
new_len : int
The length of each segment.
step : int, default 1
The offset between the start of each segment.
new_axis : int, optional
The position where the newly created axis is to be inserted. By
default, the axis will be added at the end of the array.
Returns
-------
arr_seg : array-like
The segmented array.
"""
# calculate shape after segmenting
new_shape = list(arr.shape)
new_shape[axis] = (new_shape[axis] - new_len + step) // step
if new_axis is None:
new_shape.append(new_len)
else:
new_shape.insert(new_axis, new_len)
# TODO: calculate new strides
strides = magic_command_returning_strides(...)
# get view with new strides
arr_seg = as_strided(arr, new_shape, strides)
return arr_seg.copy()
所以我想指定要切割成段的轴、段的长度和它们之间的步长。此外,我想将插入新轴的位置作为参数传递。唯一缺少的是步幅的计算。
我知道这可能无法直接使用 as_strided
以这种方式工作,即我可能需要实现一个子例程,该子例程返回带有 step=1
的跨步 View ,并且new_axis
在一个固定的位置,然后用所需的 step
切片,然后转置。
这是一段有效的代码,但显然很慢:
def segment_slow(arr, axis, new_len, step=1, new_axis=None):
""" Segment an array along some axis. """
# calculate shape after segmenting
new_shape = list(arr.shape)
new_shape[axis] = (new_shape[axis] - new_len + step) // step
if new_axis is None:
new_shape.append(new_len)
else:
new_shape.insert(new_axis, new_len)
# check if the new axis is inserted before the axis to be segmented
if new_axis is not None and new_axis <= axis:
axis_in_arr_seg = axis + 1
else:
axis_in_arr_seg = axis
# pre-allocate array
arr_seg = np.zeros(new_shape, dtype=arr.dtype)
# setup up indices
idx_old = [slice(None)] * arr.ndim
idx_new = [slice(None)] * len(new_shape)
# get order of transposition for assigning slices to the new array
order = list(range(arr.ndim))
if new_axis is None:
order[-1], order[axis] = order[axis], order[-1]
elif new_axis > axis:
order[new_axis-1], order[axis] = order[axis], order[new_axis-1]
# loop over the axis to be segmented
for n in range(new_shape[axis_in_arr_seg]):
idx_old[axis] = n * step + np.arange(new_len)
idx_new[axis_in_arr_seg] = n
arr_seg[tuple(idx_new)] = np.transpose(arr[idx_old], order)
return arr_seg
这是对基本功能的测试:
import numpy.testing as npt
arr = np.array([[0, 1, 2, 3],
[4, 5, 6, 7],
[8, 9, 10, 11]])
arr_seg_1 = segment_slow(arr, axis=1, new_len=3, step=1)
arr_target_1 = np.array([[[0, 1, 2], [1, 2, 3]],
[[4, 5, 6], [5, 6, 7]],
[[8, 9, 10], [9, 10, 11]]])
npt.assert_allclose(arr_target_1, arr_seg_1)
arr_seg_2 = segment_slow(arr, axis=1, new_len=3, step=1, new_axis=1)
arr_target_2 = np.transpose(arr_target_1, (0, 2, 1))
npt.assert_allclose(arr_target_2, arr_seg_2)
arr_seg_3 = segment_slow(arr, axis=0, new_len=2, step=1)
arr_target_3 = np.array([[[0, 4], [1, 5], [2, 6], [3, 7]],
[[4, 8], [5, 9], [6, 10], [7, 11]]])
npt.assert_allclose(arr_target_3, arr_seg_3)
如有任何帮助,我们将不胜感激!
最佳答案
基于 DanielF的评论和他的 answer here ,我这样实现了我的功能:
def segment(arr, axis, new_len, step=1, new_axis=None, return_view=False):
""" Segment an array along some axis.
Parameters
----------
arr : array-like
The input array.
axis : int
The axis along which to segment.
new_len : int
The length of each segment.
step : int, default 1
The offset between the start of each segment.
new_axis : int, optional
The position where the newly created axis is to be inserted. By
default, the axis will be added at the end of the array.
return_view : bool, default False
If True, return a view of the segmented array instead of a copy.
Returns
-------
arr_seg : array-like
The segmented array.
"""
old_shape = np.array(arr.shape)
assert new_len <= old_shape[axis], \
"new_len is bigger than input array in axis"
seg_shape = old_shape.copy()
seg_shape[axis] = new_len
steps = np.ones_like(old_shape)
if step:
step = np.array(step, ndmin = 1)
assert step > 0, "Only positive steps allowed"
steps[axis] = step
arr_strides = np.array(arr.strides)
shape = tuple((old_shape - seg_shape) // steps + 1) + tuple(seg_shape)
strides = tuple(arr_strides * steps) + tuple(arr_strides)
arr_seg = np.squeeze(
as_strided(arr, shape = shape, strides = strides))
# squeeze will move the segmented axis to the first position
arr_seg = np.moveaxis(arr_seg, 0, axis)
# the new axis comes right after
if new_axis is not None:
arr_seg = np.moveaxis(arr_seg, axis+1, new_axis)
else:
arr_seg = np.moveaxis(arr_seg, axis+1, -1)
if return_view:
return arr_seg
else:
return arr_seg.copy()
这适用于我的一维分割案例,但是,我建议任何寻找适用于任意维度分割的方法的人查看链接答案中的代码。
关于python - 使用 as_strided 分割 numpy 数组,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/48702039/
我正在处理一组标记为 160 个组的 173k 点。我想通过合并最接近的(到 9 或 10 个组)来减少组/集群的数量。我搜索过 sklearn 或类似的库,但没有成功。 我猜它只是通过 knn 聚类
我有一个扁平数字列表,这些数字逻辑上以 3 为一组,其中每个三元组是 (number, __ignored, flag[0 or 1]),例如: [7,56,1, 8,0,0, 2,0,0, 6,1,
我正在使用 pipenv 来管理我的包。我想编写一个 python 脚本来调用另一个使用不同虚拟环境(VE)的 python 脚本。 如何运行使用 VE1 的 python 脚本 1 并调用另一个 p
假设我有一个文件 script.py 位于 path = "foo/bar/script.py"。我正在寻找一种在 Python 中通过函数 execute_script() 从我的主要 Python
这听起来像是谜语或笑话,但实际上我还没有找到这个问题的答案。 问题到底是什么? 我想运行 2 个脚本。在第一个脚本中,我调用另一个脚本,但我希望它们继续并行,而不是在两个单独的线程中。主要是我不希望第
我有一个带有 python 2.5.5 的软件。我想发送一个命令,该命令将在 python 2.7.5 中启动一个脚本,然后继续执行该脚本。 我试过用 #!python2.7.5 和http://re
我在 python 命令行(使用 python 2.7)中,并尝试运行 Python 脚本。我的操作系统是 Windows 7。我已将我的目录设置为包含我所有脚本的文件夹,使用: os.chdir("
剧透:部分解决(见最后)。 以下是使用 Python 嵌入的代码示例: #include int main(int argc, char** argv) { Py_SetPythonHome
假设我有以下列表,对应于及时的股票价格: prices = [1, 3, 7, 10, 9, 8, 5, 3, 6, 8, 12, 9, 6, 10, 13, 8, 4, 11] 我想确定以下总体上最
所以我试图在选择某个单选按钮时更改此框架的背景。 我的框架位于一个类中,并且单选按钮的功能位于该类之外。 (这样我就可以在所有其他框架上调用它们。) 问题是每当我选择单选按钮时都会出现以下错误: co
我正在尝试将字符串与 python 中的正则表达式进行比较,如下所示, #!/usr/bin/env python3 import re str1 = "Expecting property name
考虑以下原型(prototype) Boost.Python 模块,该模块从单独的 C++ 头文件中引入类“D”。 /* file: a/b.cpp */ BOOST_PYTHON_MODULE(c)
如何编写一个程序来“识别函数调用的行号?” python 检查模块提供了定位行号的选项,但是, def di(): return inspect.currentframe().f_back.f_l
我已经使用 macports 安装了 Python 2.7,并且由于我的 $PATH 变量,这就是我输入 $ python 时得到的变量。然而,virtualenv 默认使用 Python 2.6,除
我只想问如何加快 python 上的 re.search 速度。 我有一个很长的字符串行,长度为 176861(即带有一些符号的字母数字字符),我使用此函数测试了该行以进行研究: def getExe
list1= [u'%app%%General%%Council%', u'%people%', u'%people%%Regional%%Council%%Mandate%', u'%ppp%%Ge
这个问题在这里已经有了答案: Is it Pythonic to use list comprehensions for just side effects? (7 个答案) 关闭 4 个月前。 告
我想用 Python 将两个列表组合成一个列表,方法如下: a = [1,1,1,2,2,2,3,3,3,3] b= ["Sun", "is", "bright", "June","and" ,"Ju
我正在运行带有最新 Boost 发行版 (1.55.0) 的 Mac OS X 10.8.4 (Darwin 12.4.0)。我正在按照说明 here构建包含在我的发行版中的教程 Boost-Pyth
学习 Python,我正在尝试制作一个没有任何第 3 方库的网络抓取工具,这样过程对我来说并没有简化,而且我知道我在做什么。我浏览了一些在线资源,但所有这些都让我对某些事情感到困惑。 html 看起来
我是一名优秀的程序员,十分优秀!