algorithm - 计算 "moving"协方差-6ren

algorithm - 计算 "moving"协方差

转载作者：塔克拉玛干更新时间：2023-11-03 03:58:01

24

4

我一直在尝试弄清楚如何有效地计算移动窗口中的协方差，即从一组值 (x[0], y[0])..(x[n-1], y[n-1]) 到一组新值 (x[1], y[1])..(x[n], y[n])。换句话说，值 (x[0], y[0]) 被值 (x[n], y[n]) 替换。出于性能原因，我需要在我想表达新协方差 Cov(x[1]..x[n], y[1]..y[n]) 的意义上逐步计算协方差先前的协方差 Cov(x[0]..x[n-1], y[0]..y[n-1]).

从这里描述的朴素的协方差公式开始:

[ https://en.wikipedia.org/wiki/Algorithms_for_calculating_variance#Covariance][1]

我能想到的是:

Cov(x[1]..x[n], y[1]..y[n]) =
Cov(x[0]..x[n-1], y[0]..y[n-1]) +
(x[n]*y[n] - x[0]*y[0]) / n -
AVG(x[1]..x[n]) * AVG(y[1]..y[n]) +
AVG(x[0]..x[n-1]) * AVG(y[0]..y[n-1])

我对符号感到抱歉，我希望它或多或少能清楚我想表达的意思。

但是，我不确定这在数值上是否足够稳定。处理大值时，我可能会遇到算术溢出或其他(例如取消)问题。

有更好的方法吗？

感谢您的帮助。

最佳答案

看起来您正在尝试某种形式的“添加新值并减去旧值”。您的担心是正确的:此方法在数值上不稳定。以这种方式求和容易发生漂移，但真正的 killer 是这样一个事实，即在每一步，您都在从另一个大数中减去一个大数，得到的可能是一个非常小的数。

一个改进是独立维护您的总和(x_i、y_i 和 x_i*y_i)，并重新计算原始公式从他们的每一步。你的运行总和仍然会漂移，朴素的公式在数值上仍然不稳定，但至少你只有一步数值不稳定。

解决此问题的一种稳定方法是实现用于(稳定地)合并统计集的公式，并使用合并树评估整体协方差。移动你的窗口会更新你的一个叶子，需要更新从那个叶子到根的每个节点。对于大小为 n 的窗口，此方法每次更新将花费 O(log n) 时间，而不是 O(1) 天真的计算，但结果将是稳定和准确的。此外，如果您不需要每个增量步骤的统计信息，您可以为每个输出样本更新一次树，而不是每个输入样本更新一次。如果每个输出样本有 k 个输入样本，这会将每个输入样本的成本降低到 O(1 + (log n)/k)。

来自评论:您引用的维基百科页面包括关于 Knuth 在线算法的部分，该部分相对稳定，但仍然容易出现偏差。您应该能够为协方差做一些类似的事情；并且每 K*n 个样本重置计算应该以最小的成本限制漂移。

关于algorithm - 计算 "moving"协方差，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/35228164/

24

4

0

文章推荐： javascript - 在有根、标记、有向树中查找所有子树重复

文章推荐： java - 提交后选择中的默认值仍然存在

文章推荐： java - 如何使用 Bootstrap 主题生成 JavaDoc？

服务器端的 Firebird 计算(计算)字段
SQL 和一般开发的新手，我有一个表(COUNTRIES)，其中包含字段(INDEX、NAME、POPULATION、AREA) 通常我添加一个客户端(Delphi)计算字段(DENSITY)和 On
jquery - 计算(百分比)计算(像素)
我想使用 calc(100%-100px)，但在我的 demo 中不起作用由于高度只接受像素，因此如何将此百分比值转换为像素。最佳答案以下将为您提供高度: $(window).height();
MySql 计算
我正在尝试在 MySQL 中添加列并动态填充其他列。例如我有一张表“数字”并具有第 1 列、第 2 列、第 3 列，这些总数应填充在第 4 列中最佳答案除非我误解了你的问题，否则你不只是在寻找:
mysql - 计算
我想返回简单计算的结果，但我不确定如何执行此操作。我的表格如下: SELECT COUNT(fb.engineer_id) AS `total_feedback`, SUM(fb.ra
嵌套for循环中的c++计算
我一直在尝试做这个程序，但我被卡住了，我仍然是一个初学者，任何帮助将不胜感激。我需要程序来做打印一个 10 X 10 的表格，其中表格中的每个条目都是行号和列号的总和包含一个累加器，用于计算所有表
c - 计算
这个计算背后一定有一些逻辑。但我无法得到它。普通数学不会导致这种行为。谁能帮我解释一下原因 printf ("float %f\n", 2/7 * 100.0); 结果打印 1.000000 为什么会
计算 AND 的算法
我想计算从 0 到 (n)^{1/2} - 1 的数字的 AND每个数字从 0 到 (n)^{1/2} - 1 .我想在 O(n) 中执行此操作时间，不能使用 XOR、OR、AND 运算。具体来说，
Excel - 在数字格式中使用公式/计算
如何在 Excel 中将公式放入自定义数字格式？例如(出于说明目的随机示例)，假设我有以下数据: 输入输出在不编辑单元格中的实际数据的情况下，我想显示单元格中的值除以 2，并保留两位小数: 有没
Flutter:隔离内存泄漏(计算)
每次我在 Flutter 应用程序中调用计算()时，我都会看到内存泄漏，据我所知，这基本上只是一种生成隔离的便捷方法。我的应用程序内存占用增加并且在 GC 之后永远不会减少。我已将我的代码简化为仅调
R中的RMSE(均方根偏差)计算
我有数字特征观察 V1通过 V12用于目标变量 Wavelength .我想计算 Vx 之间的 RMSE列。数据格式如下。每个变量“Vx”以 5 分钟的间隔进行测量。我想计算所有 Vx 变量的观测值
计算 C 文件中未知数量的字符
我正在寻找一种使用 C 语言计算文件中未知字符数的简单方法。谢谢你的帮助最佳答案 POSIX 方式(可能是您想要的方式): off_t get_file_length( FILE *file ) {
sql - 计算/派生连续日期跨度中的第一个开始日期
我正在使用 Postgres，并且我正试图围绕如何在连续日期跨度中得出第一个开始日期的问题进行思考。例如 :- ID | Start Date | End Date =================
jquery - 计算，用逗号替换点
我有一个订单表格，我在其中使用 jQuery 计算插件来汇总总数。此求和工作正常，但生成的“总和”存在问题。总之，我希望用逗号替换任何点。代码的基础是； function ($this) {
Delphi错误的 double 计算
我在使用 double 变量计算简单算术方程时遇到问题。我有一个具有 double 属性 Value 的组件，我将此属性设置为 100。然后我做一个简单的减法来检查这个值是否真的是 100: va
openssl CRC32 计算
我在这里看到了一些关于 CRC 32 计算的其他问题。但没有一个让我满意，因此是这样。 openssl 库是否有任何用于计算 CRC32 的 api 支持？我已经在为 SHA1 使用 openssl，
php - 计算-1个月时的PHP天错误
当我在PHP日期计算中遇到问题时，我感到惊讶。 $add = '- 30 days'; echo date('Y-m-01', strtotime($add)); // result is 2017-
持有变量的 JavaScript 计算
我正在使用 javascript 进行练习，我编写了这个脚本来计算 2 个变量的总和，然后在第三个方程中使用这个总和!关于如何完成这项工作的任何想法都将非常有用! First Number:
audio - sample 计算
我有一个来自EAC的提示单和一个包含完整专辑的FLAC文件。我正在尝试制作一些python脚本来播放文件，因为我需要能够设置在flac文件中开始的位置。如何从CueSheet格式MM:SS:FF转
javascript - 计算 for 循环中输入值的总和
这个问题已经有答案了: Adding two numbers concatenates them instead of calculating the sum (24 个回答) 已关闭去年。我有一个
使用输入和跨度字段的 Javascript 计算
4000 我需要上面字段 name="quantity" 和 id="price" 中的值，并使用 javascript 函数进行计算，并将其显示在字段 id= 中仅当我单击计算按钮时才显示“总

首页

博学

6Ren·AI

商城

algorithm - 计算 "moving"协方差