- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
有许多压缩协议(protocol)支持多核/线程压缩/解压缩。然而,基本的解压/压缩方法似乎都使用单核(即使至少算法支持多核)。
如果没有现有工具可以完成此任务,是否有办法在不使用 Java 或 C 的情况下管理它?
我认为我可以使用管道
或序列化
的能力,通过以某种方式将R对象传递到shell/命令行来获得我想要的东西。但是,我似乎无法以这种方式从 R 中获得对象的可用形式(也许我错过了一些东西?)。 “显而易见”的解决方案是使用 dput,但该函数帮助中的注释非常清楚地表明,使用 dput 将 R 对象转换为 ASCII 是为了保存对于dput
来说不是一个合适(或安全)的目的。提到的替代方案 dump
的作用类似于 save
(我宁愿使用 saveRDS
之类的东西),并且仍然将文件路由到 。如果不深入研究 R 的 C 代码,内部
是难以理解的。
我应该考虑哪些其他方法来解决这个问题?
最佳答案
利用@Martin提供的资源,我编写了以下代码。
对于压缩,我想先尝试使用 xz。然而,目前 Ubuntu 14.04 LTS 上打包的 xz 版本(5.1.0alpha)不支持并行压缩。所以,我用 pxz 代替。
saveRDS.xz <- function(object,file,threads=parallel::detectCores()) {
con <- pipe(paste0("pxz -T",threads," > ",file),"wb")
saveRDS(object, file = con, compress=FALSE)
close(con)
}
配套代码 readRDS.xz 代码也适用于使用 xz 压缩保存的任何常规 RDS 文件。另请注意,虽然 pxz 不会并行解压缩,但使用此代码可以节省时间(在我的系统上节省了大约 1/3)。这是因为解压缩转移到另一个线程,而 R 线程被留下来处理传入的流。在我的系统上,R 的单线程 CPU 使用率远远早于 pxz 达到最大值。
readRDS.xz <- function(file,threads=parallel::detectCores()) {
con <- pipe(paste0("pxz -d -k -c -T",threads," ",file))
object <- readRDS(file = con)
close(con)
return(object)
}
或者我们可以使用pigz (gz)来压缩和解压缩。
saveRDS.gz <- function(object,file,threads=parallel::detectCores()) { con <- 管道(paste0("pigz -p",线程,">",文件),"wb") saveRDS(对象,文件= con) 关闭(反)}
pigz中的解压并不完全是多线程的。但与 xz 一样,从 R 线程中解压会带来速度优势。在我的系统上,pxz 和 Pigz 提供相似的解压时间(可能是由于上一节中提到的 R 瓶颈)。
saveRDS.gz <- function(object,file,threads=parallel::detectCores()) {
con <- pipe(paste0("pigz -p",threads," > ",file),"wb")
saveRDS(object, file = con)
close(con)
}
readRDS.gz <- function(file,threads=parallel::detectCores()) {
con <- pipe(paste0("pigz -d -c -p",threads," ",file))
object <- readRDS(file = con)
close(con)
return(object)
}
为我提供的性能介于其他两者之间,因此我在这里跳过它。
建立这些函数后,我们可以编写一个快速包装器,以便它做正确的事情。
readRDS.p <- function(file,threads=parallel::detectCores()) {
#Hypothetically we could use initial bytes to determine file format, but here we use the Linux command file because the readBin implementation was not immediately obvious
fileDetails <- system2("file",args=file,stdout=TRUE)
selector <- sapply(c("gzip","XZ"),function (x) {grepl(x,fileDetails)})
format <- names(selector)[selector]
if (format == "gz") {
object <- readRDS.gz(file, threads=threads)
} else if (format == "XZ") {
object <- readRDS.xz(file, threads=threads)
} else {
object <- readRDS(file)
}
return(object)
}
关于r - 在 R 中使用多线程/核心以压缩形式保存对象的方法是什么?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/28927750/
我尝试根据表单元素的更改禁用/启用保存按钮。但是,当通过弹出按钮选择更改隐藏输入字段值时,保存按钮不受影响。 下面是我的代码。我正在尝试序列化旧的表单值并与更改后的表单值进行比较。但我猜隐藏的字段值无
我正在尝试保存模型的实例,但我得到了 Invalid EmbeddedDocumentField item (1) 其中 1 是项目的 ID(我认为)。 模型定义为 class Graph(Docum
我有一个非常奇怪的问题......在我的 iPhone 应用程序中,用户可以打开相机胶卷中的图像,在我的示例中 1920 x 1080 像素 (72 dpi) 的壁纸。 现在,想要将图像的宽度调整为例
目前,我正在使用具有排序/过滤功能的数据表成功地从我的数据库中显示图像元数据。在我的数据表下方,我使用第三方图像覆盖流( http://www.jacksasylum.eu/ContentFlow/
我的脚本有问题。我想按此顺序执行以下步骤: 1. 保存输入字段中的文本。 2. 删除输入字段中的所有文本。 3. 在输入字段中重新加载之前删除的相同文本。 我的脚本的问题是 ug()- 函数在我的文本
任何人都可以帮助我如何保存多对多关系吗?我有任务,用户可以有很多任务,任务可以有很多用户(多对多),我想要实现的是,在更新表单中,管理员可以将多个用户分配给特定任务。这是通过 html 多选输入来完成
我在 Tensorflow 中训练了一个具有批归一化的模型。我想保存模型并恢复它以供进一步使用。批量归一化是通过 完成的 def batch_norm(input, phase): retur
我遇到了 grails 的问题。我有一个看起来像这样的域: class Book { static belongsTo = Author String toString() { tit
所以我正在开发一个应用程序,一旦用户连接(通过 soundcloud),就会出现以下对象: {userid: userid, username: username, genre: genre, fol
我正在开发一个具有多选项卡布局的 Angular 7 应用程序。每个选项卡都包含一个组件,该组件可以引用其他嵌套组件。 当用户选择一个新的/另一个选项卡时,当前选项卡上显示的组件将被销毁(我不仅仅是隐
我尝试使用 JEditorPane 进行一些简单的文本格式化,但随着知识的增长,我发现 JTextPane 更容易实现并且更强大。 我的问题是如何将 JTextPane 中的格式化文本保存到文件?它应
使用 Docker 相当新。 我为 Oracle 11g Full 提取了一个图像。创建了一个数据库并将应用程序安装到容器中。 正确配置后,我提交了生成 15GB 镜像的容器。 测试了该图像的新容器,
我是使用 Xcode 和 swift 的新手,仍在学习中。我在将核心数据从实体传递到文本字段/标签时遇到问题,然后用户可以选择编辑和保存记录。我的目标是,当用户从 friendslistViewCon
我正在用 Java 编写 Android 游戏,我需要一种可靠的方法来快速保存和加载应用程序状态。这个问题似乎适用于大多数 OO 语言。 了解我需要保存的内容:我正在使用策略模式来控制我的游戏实体。我
我想知道使用 fstream 加载/保存某种结构类型的数组是否是个好主意。注意,我说的是加载/保存到二进制文件。我应该加载/保存独立变量,例如 int、float、boolean 而不是结构吗?我这么
我希望能够将 QNetworkReply 保存到 QString/QByteArray。在我看到的示例中,它们总是将流保存到另一个文件。 目前我的代码看起来像这样,我从主机那里得到一个字符串,我想做的
我正在创建一个绘图应用程序。我有一个带有 Canvas 的自定义 View ,它根据用户输入绘制线条: class Line { float startX, startY, stopX, stop
我有 3 个 Activity 第一个 Activity 调用第二个 Activity ,第二个 Activity 调用第三个 Activity 。 第二个 Activity 使用第一个 Activi
我想知道如何在 Xcode 中保存 cookie。我想使用从一个网页获取的 cookie 并使用它访问另一个网页。我使用下面的代码登录该网站,我想保存从该连接获得的 cookie,以便在我建立另一个连
我有一个 SQLite 数据库存储我的所有日历事件,建模如下: TimerEvent *Attributes -date -dateForMark -reminder *Relat
我是一名优秀的程序员,十分优秀!