recovery - 抗电源/硬件/操作系统故障的程序-6ren

recovery - 抗电源/硬件/操作系统故障的程序

转载作者：行者123 更新时间：2023-12-04 15:59:00

30

4

我需要编写一个程序，在可能状态的大空间中执行并行搜索，在此过程中发现了新区域(并开始了他们的探索)，并且由于在其他地方获得的中间结果消除了可能性，因此提前终止了对某些区域的探索在其中发现新的有用结果。搜索是使用彼此大量协作运行的多个线程来执行的，以避免重新计算中间数据。

一个复杂的内部状态(包括几个线程的调用栈和它们使用的状态同步原语)必须在整个过程中维护和更新，并且没有明显的方法将计算拆分成可以顺序执行的隔离块，每个块都节省了并将一个小的中间结果传递给下一个。此外，无法将计算拆分为不相互通信的独立并行线程，而不会因重新计算大量中间数据而产生过高的开销。

由于搜索域很大，该程序可能会运行数月才能产生最终结果。因此，在程序执行期间存在电源、硬件或操作系统故障的重大风险，这可能导致目前已完成的所有工作完全丢失。在这种情况下，程序需要从头开始重新启动所有计算。

在这种情况下，我需要一个可以防止数据完全丢失的解决方案。我想到了一个执行引擎/平台，它可以不断地将进程的当前状态保存到像冗余磁盘阵列或数据库这样的抗故障存储中。但我知道这种方法会显着减慢进程，甚至在与预期的计算时间(包括由于可能的故障而重新启动)相比没有任何好处的情况下也会减慢进程的速度。

事实上，我不需要一个理想的解决方案来持续保存程序状态，我可以轻松承受数小时甚至数天的工作损失。我想到的一个可能的重量级解决方案是在虚拟机内运行该程序，不时保存其快照，并在可能的主机故障后从最近的快照恢复机器。这种方法还有助于在随机或可预防的 guest 操作系统故障后恢复程序状态。

是否有类似但更轻量级的解决方案仅限于保留单个进程的状态？或者你能提出任何其他可以解决我的问题的方法吗？

最佳答案

您可能需要考虑使用 Erlang，它允许以相对较低的成本运行大量线程。因为线程成本低，所以可以使用冗余来提高可靠性。

对于您提出的问题，三重冗余方案可能是可行的方法，其中定期检查三个(或更多)系统之间的同步将通过投票确定谁失败。

关于recovery - 抗电源/硬件/操作系统故障的程序，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/18067787/

30

4

0

文章推荐： windows-phone-8-emulator - 运行 windows phone8 应用程序部署失败

文章推荐： imap - 缺少 CR - TCP 采样器

文章推荐： scala - 这种类型参数语法无法编译的原因是什么？

文章推荐： ruby-on-rails-3 - 如何在 Rails 中实现 HATEOAS

C 程序我想知道是否有办法简化我的 dayofyear 程序？
我是 C 语言新手，我编写了这个 C 程序，让用户输入一年中的某一天，作为返回，程序将输出月份以及该月的哪一天。该程序运行良好，但我现在想简化该程序。我知道我需要一个循环，但我不知道如何去做。这是程序
java - GUI Java 程序 - Paint 程序
我一直在努力找出我的代码有什么问题。这个想法是创建一个小的画图程序，并有红色、绿色、蓝色和清除按钮。我有我能想到的一切让它工作，但无法弄清楚代码有什么问题。程序打开，然后立即关闭。 import ja
homebrew - 从 Homebrew 程序/欺骗程序到 Homebrew 程序/核心的迁移是什么？
我想安装screen，但是接下来我应该做什么？ $ brew search screen imgur-screenshot screen
python - 客户端(python 程序)没有收到服务器(c 程序)返回的响应？
我有一个在服务器端工作的 UDP 套接字应用程序。为了测试服务器端，我编写了一个简单的 python 客户端程序，它发送消息“hello world how are you”。服务器随后应接收消息，将
python - 运行一个 shell 脚本，该脚本运行一个 python 程序，然后运行一个 R 程序
我有一个 shell 脚本，它运行一个 Python 程序来预处理一些数据，然后运行一个 R 程序来执行一些长时间运行的任务。我正在学习使用 Docker 并且我一直在运行 FROM r-base:l
python - 在 Linux 中从 Python 启动一个 c 程序，将一个大文本字符串作为参数传递给 c 程序
在 Linux 中。我有一个 c 程序，它读取一个 2048 字节的文本文件作为输入。我想从 Python 脚本启动 c 程序。我希望 Python 脚本将文本字符串作为参数传递给 c 程序，而不是将
在网页上调起本机C#程序
前言最近开始整理笔记里的库存草稿，本文是 23 年 5 月创建的了（因为中途转移到 onedrive，可能还不止）网页调起电脑程序是经常用到的场景，比如百度网盘下载，加入 QQ 群之类的我
VHDL 程序
对于一个类，我被要求编写一个 VHDL 程序，该程序接受两个整数输入 A 和 B，并用 A+B 替换 A，用 A-B 替换 B。我编写了以下程序和测试平台。它完成了实现和行为语法检查，但它不会模拟。尽
haskell 程序
module Algorithm where import System.Random import Data.Maybe import Data.List type Atom = String ty
求给定N个数的最小公倍数的C++程序
我想找到两个以上数字的最小公倍数求给定N个数的最小公倍数的C++程序最佳答案 int lcm(int a, int b) { return (a/gcd(a,b))*b; } 对于gcd，请查看
索引器的c#程序
这个程序有错误。谁能解决这个问题？ Error is :TempRecord already defines a member called 'this' with the same paramete
铁路围栏密码的C++程序
当我运行下面的程序时，我在 str1 和 str2 中得到了垃圾值。所以 #include #include #include using namespace std; int main() {
死兔子的C++程序
这是我的作业: 一对刚出生的兔子(一公一母)被放在田里。兔子在一个月大时可以交配，因此在第二个月的月底，每对兔子都会生出两对新兔子，然后死去。注:在第0个月，有0对兔子。第 1 个月，有 1 对兔子
十进制转十六进制的C++程序
我编写了一个程序，通过对字母使用 switch 命令将十进制字符串转换为十六进制，但是如果我使用 char，该程序无法正常工作!没有 switch 我无法处理 9 以上的数字。我希望你能理解我，因为我
连接MySQL的C++程序
我是 C++ 新手(虽然我有一些 C 语言经验)和 MySQL，我正在尝试制作一个从 MySQL 读取数据库的程序，我一直在关注这个 tutorial但当我尝试“构建”解决方案时出现错误。 (我正在使
Swift If 程序
仍然是一个初学者，只是尝试使用 swift 中的一些基本函数。有人能告诉我这段代码有什么问题吗？ import UIKit var guessInt: Int var randomNum = arc
折叠常量的C++程序
我正在用 C++11 编写一个函数，它采用 constant1 + constant2 形式的表达式并将它们折叠起来。 constant1 和 constant2 存储在 std::string 中，
2个矩阵相加和相乘的C++程序
我用 C++ 编写了这段代码，使用运算符重载对 2 个矩阵进行加法和乘法运算。当我执行代码时，它会在第 57 行和第 59 行产生错误，非法结构操作(两行都出现相同的错误)。请解释我的错误。提前致谢:
交换字符串中两个字符的C++程序
我是 C++ 的初学者，我想编写一个简单的程序来交换字符串中的两个字符。例如；我们输入这个字符串:“EXAMPLE”，我们给它交换这两个字符:“E”和“A”，输出应该类似于“AXEMPLA”。我在
确定三角形的C++程序
我需要以下代码的帮助: 声明 3 个 double 类型变量，每个代表三角形的三个边中的一个。提示用户为第一面输入一个值，然后将用户的输入设置为您创建的代表三角形第一条边的变量。将最后 2 个步

首页

博学

6Ren·AI

商城

recovery - 抗电源/硬件/操作系统故障的程序