- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
因此,我正在尝试计算两个任意维度矩阵的克罗内克积。 (为了示例,我使用了相同维度的方阵)
最初我尝试使用 kron
:
a = np.random.random((60,60))
b = np.random.random((60,60))
start = time.time()
a = np.kron(a,b)
end = time.time()
Output: 0.160096406936645
为了尝试加快速度,我使用了 tensordot
:
a = np.random.random((60,60))
b = np.random.random((60,60))
start = time.time()
a = np.tensordot(a,b,axes=0)
a = np.transpose(a,(0,2,1,3))
a = np.reshape(a,(3600,3600))
end = time.time()
Output: 0.11808371543884277
在网络上稍作搜索后,我发现(或者至少据我所知)numpy 在必须 reshape 已转置的张量时会生成一个额外的副本。
然后我尝试了以下(这段代码显然没有给出 a 和 b 的克罗内克积,但我只是作为测试这样做):
a = np.random.random((60,60))
b = np.random.random((60,60))
start = time.time()
a = np.tensordot(a,b,axes=0)
a = np.reshape(a,(3600,3600))
end = time.time()
Output: 0.052041053771972656
我的问题是:如何在不遇到与转置相关的问题的情况下计算克罗内克积?
我只是在寻找更快的速度,所以解决方案不必使用 tensordot
。
编辑
我刚刚在这个堆栈帖子中找到:speeding up numpy kronecker products ,还有另一种方法:
a = np.random.random((60,60))
b = np.random.random((60,60))
c = a
start = time.time()
a = a[:,np.newaxis,:,np.newaxis]
a = a[:,np.newaxis,:,np.newaxis]*b[np.newaxis,:,np.newaxis,:]
a.shape = (3600,3600)
end = time.time()
test = np.kron(c,b)
print(np.array_equal(a,test))
print(end-start)
Output: True
0.05503702163696289
我仍然对您是否可以进一步加快此计算的问题感兴趣?
最佳答案
einsum
似乎有效:
>>> a = np.random.random((60,60))
>>> b = np.random.random((60,60))
>>> ab = np.kron(a,b)
>>> abe = np.einsum('ik,jl', a, b).reshape(3600,3600)
>>> (abe==ab).all()
True
>>> timeit(lambda: np.kron(a, b), number=10)
1.0697475590277463
>>> timeit(lambda: np.einsum('ik,jl', a, b).reshape(3600,3600), number=10)
0.42500176999601535
简单的广播甚至更快:
>>> abb = (a[:, None, :, None]*b[None, :, None, :]).reshape(3600,3600)
>>> (abb==ab).all()
True
>>> timeit(lambda: (a[:, None, :, None]*b[None, :, None, :]).reshape(3600,3600), number=10)
0.28011218502069823
更新:使用 blas 和 cython 我们可以获得另一个适度 (30%) 的加速。自己决定是否值得麻烦。
[设置.py]
from distutils.core import setup
from Cython.Build import cythonize
setup(name='kronecker',
ext_modules=cythonize("cythkrn.pyx"))
[cythkrn.pyx]
import cython
cimport scipy.linalg.cython_blas as blas
import numpy as np
@cython.boundscheck(False)
@cython.wraparound(False)
def kron(double[:, ::1] a, double[:, ::1] b):
cdef int i = a.shape[0]
cdef int j = a.shape[1]
cdef int k = b.shape[0]
cdef int l = b.shape[1]
cdef int onei = 1
cdef double oned = 1
cdef int m, n
result = np.zeros((i*k, j*l), float)
cdef double[:, ::1] result_v = result
for n in range(i):
for m in range(k):
blas.dger(&l, &j, &oned, &b[m, 0], &onei, &a[n, 0], &onei, &result_v[m+k*n, 0], &l)
return result
构建运行 cython cythkrn.pyx
然后 python3 setup.py build
。
>>> from timeit import timeit
>>> import cythkrn
>>> import numpy as np
>>>
>>> a = np.random.random((60,60))
>>> b = np.random.random((60,60))
>>>
>>> np.all(cythkrn.kron(a, b)==np.kron(a, b))
True
>>>
>>> timeit(lambda: cythkrn.kron(a, b), number=10)
0.18925874299020506
关于python - 加速 Kronecker 产品 Numpy,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/56067643/
我在构建执行特定任务的可变参数函数时遇到问题。对于我的特定示例,我使用的是 2x2 矩阵,但您可以想象我的问题可以推广到许多数据类型。此外,对于我的示例,“眼睛”是 2x2 单位矩阵。 好的,所以我想
我正在尝试使用 cvxpy 进行优化。 w=cvxpy.Variable((10,1)) cvxpy.kron(w,w) 这不起作用说第一个参数应该是常量, 然后我尝试使用 numpy numpy.k
我想加速以下 for 循环。 % Use random matrices for testing. % Elapsed time of the following code is around 19
关闭。这个问题需要更多focused .它目前不接受答案。 想改进这个问题吗? 更新问题,使其只关注一个问题 editing this post . 关闭 5 年前。 Improve this qu
因此,我正在尝试计算两个任意维度矩阵的克罗内克积。 (为了示例,我使用了相同维度的方阵) 最初我尝试使用 kron : a = np.random.random((60,60)) b = np.ran
我正在从事我的第一个大型 Python 项目。我有一个函数,其中包含以下代码: # EXPAND THE EXPECTED VALUE TO APPLY TO ALL STAT
背景 生成随机权重列表后: sizes = [784,30,10] weights = [np.random.randn(y, x) for x, y in zip(sizes[:-1],sizes[
我正在尝试计算 张量积(更新:我想要的实际上叫做 Kronecker product ,这种命名困惑是我找不到 np.kron 的原因) 的多个矩阵,这样我就可以将变换应用于向量,这些向量本身就是多个
我可以通过放弃 for 循环来优化 Matlab 中的以下代码吗? A = []; B = randn(4,8); C = randn(8,4); I = randperm(8,3); J = ran
我正在开发一个 python 项目并使用 numpy。我经常需要通过单位矩阵计算矩阵的克罗内克积。这些是我代码中的一个相当大的瓶颈,所以我想优化它们。我必须服用两种产品。第一个是: np.kron(n
假设我们有 2 个 2X2 numpy 数组: X=np.array([[0,1],[1,0]]) 和 I=np.array([[1,0],[0,1]]) 考虑一下克罗内克产品 XX=X^X 我让符号
我正在尝试仅使用 repmat 和 reshape 来复制 Kron 产品,我相信我已经非常接近了,但我无法完成最后一次正确的 reshape 。特别是我在 reshape A 时遇到问题 为简单起见
我是一名优秀的程序员,十分优秀!