- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在处理一个矩阵必须多次迭代计算的问题。必要的矩阵乘法采用以下形式
t(X) %*% ( ( X %*% W %*% t(X) * mu0 ) * mu1 )
其中 X
是 N x P
而 W
是一个对称 P x P
矩阵。 mu0
和 mu1
是 N x 1
向量,计算成本低,并按元素输入各自的乘积。
不幸的是,N
可能非常大,这会导致巨大的计算需求,因为 X %*% W %*% t(X)
是 N×N
。我想知道是否有任何策略或计算技巧,例如基于矩阵分解,可以用来加速这里的计算。在每次迭代中,mu0
和 mu1
都会发生变化,但是 X
和 W
是固定的,因此包括这些矩阵在内的任何预计算将工作。
基准测试
到目前为止,我能想到的最快方法是进行一些明显的预计算:
# fake data
N = 2500
P = 10
X = matrix(rnorm(N*P), N, P)
W = matrix(rnorm(P*P), P, P)
mu0 = rnorm(N)
mu1 = rnorm(N)
# precomputations
tX = t(X)
XWX = X %*% W %*% t(X)
# functions
f_raw = function(X, W, mu0, mu1){t(X) %*% ( ( X %*% W %*% t(X) * mu0 ) * mu1 )}
f_precomp = function(XWX, tX, mu0, mu1){tX %*% ( ( XWX * mu0 ) * mu1 )}
# benchmark
microbenchmark::microbenchmark(f_raw(X, W, mu0, mu1),
f_precomp(XWX, tX, mu0, mu1))
Unit: milliseconds
expr min lq mean median uq max neval
f_raw(X, W, mu0, mu1) 283.5918 286.5080 299.4621 289.5151 302.9726 355.4271 100
f_precomp(XWX, tX, mu0, mu1) 167.4169 168.7336 180.6468 171.0852 197.7475 263.8090 100
最佳答案
您的示例数据和尝试:
# fake data
N = 2500
P = 10
X = matrix(rnorm(N*P), N, P)
W = matrix(rnorm(P*P), P, P)
mu0 = rnorm(N)
mu1 = rnorm(N)
# precomputations
tX = t(X)
XWX = X %*% W %*% t(X)
# functions
f_raw = function(X, W, mu0, mu1){t(X) %*% ( ( X %*% W %*% t(X) * mu0 ) * mu1 )}
f_precomp = function(XWX, tX, mu0, mu1){tX %*% ( ( XWX * mu0 ) * mu1 )}
更好的办法是预先计算
WX <- tcrossprod(W, X)
然后
f_better <- function (X, mu0, mu1, WX) crossprod(X, (mu0 * mu1) * X) %*% WX
在我的笔记本电脑上进行基准测试:
microbenchmark::microbenchmark(f_raw(X, W, mu0, mu1),
f_precomp(XWX, tX, mu0, mu1),
f_better(X, mu0, mu1, WX))
#Unit: milliseconds
# expr min lq mean median
# f_raw(X, W, mu0, mu1) 236.926979 238.984573 243.86319 242.212716
# f_precomp(XWX, tX, mu0, mu1) 151.190689 152.612059 156.25277 155.646093
# f_better(X, mu0, mu1, WX) 1.113031 1.126434 1.17974 1.138207
# uq max neval
# 244.721163 270.477737 100
# 157.970378 182.935082 100
# 1.146352 5.130876 100
验证正确性:
ans_raw <- f_raw(X, W, mu0, mu1)
ans_precomp <- f_precomp(XWX, tX, mu0, mu1)
ans_better <- f_better(X, mu0, mu1, WX)
all.equal(ans_raw, ans_precomp)
# [1] TRUE
all.equal(ans_raw, ans_better)
# [1] TRUE
不知道mu0
和mu1
在你的实际应用中是否保证是非负的。如果是这样,则以下速度快 2 倍:
f_fastest <- function (X, mu0, mu1, WX) crossprod(sqrt(mu0 * mu1) * X) %*% WX
关于r - 通过预计算加速矩阵乘积,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/72613867/
我希望我的问题有一个非常简单的解决方案。我只是找不到它: 假设您有两个向量(一个是列向量,一个是行向量)A、B: A = [1,2,3] B = [4;5;6] 如果我们按如下方式将它们相乘,我们会得
我有一个 Tuple 的列表: "dog", 25 "cat", 5 "cat", 7 "rat", 4 "dog", 10 我需要的 Linq 查询规则必须满足以下条件:我需要按字符串值对元组进行分
给定 2 个不同的 NDarray,A 和 B,形状相同但尺寸任意,我如何获得 NDarray C,其中 C 是 A 和 B(含)范围内所有整数的乘积。 我的意思是A是起始数组,B是结束数组,我想要数
假设我需要为某些输入构建一个真值表,它要求我提供逻辑和、算术和和逻辑乘积。它们之间有什么区别? 最佳答案 逻辑和 - 一种计算机加法,当一个或两个输入变量为 1 时,结果为 1;当输入变量均为 0 时
我正在尝试执行一个简单的矩阵乘法 vector 乘法,但出于某种原因,我在几次乘法的结果中得到了错误的符号。我不知道为什么会这样,任何指针将不胜感激。 这是我的全部代码,即矩阵 * vector 函数
我在上一个主题中找到了一些关于 cuda 矩阵 vector 积的代码: Matrix-vector multiplication in CUDA: benchmarking & performanc
我遇到的第一个问题是显示三个数字中的最小和最大。出现两个单独的警报 - 第一个警报说第二大数字是最大的(因为它还没有考虑第三个数字),第二个警报正确地指出三个中最大的数字是最大的.不确定为什么会这样—
我有两个矩阵 a = np.matrix([[1,2], [3,4]]) b = np.matrix([[5,6], [7,8]]) 我想得到元素乘积,[[1*5,2*6], [3*7,4*8]],等
我有一个数组和一个 vector : ArrayXd m1(3, 1337); ArrayXd v1(1, 1337); ArrayXd result(3, 1337); 现在我想将 m1 的每一行与
我有两个 3D 矩阵: a = np.random.normal(size=[3,2,5]) b = np.random.normal(size=[5,2,3]) 我想要每个切片分别沿 2 轴和 0
我正在创建一个 C++ 软件,我需要一个包装器,它基于 Eigen 库,实现类似于官方网页中解释的运算符* https://eigen.tuxfamily.org/dox/group__Matrixf
我正在尝试将张量 (m, n, o) 分解为矩阵 A(m, r)、B (n, r) 和 C (k, r)。这被称为 PARAFAC 分解。 Tensorly已经做了这种分解。 一个重要的步骤是将 A、
我目前正面临这个问题。我有两个矩阵 MatrixXf答: 0.5 0.5 0.5 0.50.694496 0.548501 0.680067 0.7171110
我有以下 df: df = pd.DataFrame({'A': ['foo', 'bar', 'dex', 'tru'], 'B': ['abc', 'def'
假设我们有 2 个 2X2 numpy 数组: X=np.array([[0,1],[1,0]]) 和 I=np.array([[1,0],[0,1]]) 考虑一下克罗内克产品 XX=X^X 我让符号
我想弄清楚这是 Eigen 中的错误还是我做错了什么。我只想要两个复数 vector [1,i] 和 [1,-i] 的点积。答案是 1*1 + i*(-i) = 2。但是 Eigen 给出的答案是零。
我的 C 代码有问题。我所做的就是这样: #include int main() { float zahlen[2]; for (int i = 0; i < 2; i++) {
为了找到数字的因数,我正在使用函数 void primeFactors(int n) # include # include # include # include using namespa
我是一名优秀的程序员,十分优秀!