- r - 以节省内存的方式增长 data.frame
- ruby-on-rails - ruby/ruby on rails 内存泄漏检测
- android - 无法解析导入android.support.v7.app
- UNIX 域套接字与共享内存(映射文件)
我想将文件从一个地方复制到另一个地方,但问题是我要处理很多稀疏文件。
有没有什么(简单的)方法可以复制稀疏文件而不会在目的地变得很大?
我的基本代码:
out, err := os.Create(bricks[0] + "/" + fileName)
in, err := os.Open(event.Name)
io.Copy(out, in)
最佳答案
请注意,io.Copy()
会通过管道传输原始字节——一旦您认为它将数据从 io.Reader
传输到 ,这就可以理解了io.Writer
对应提供了Read([]byte)
和Write([]byte)
。因此,io.Copy()
绝对能够处理任何提供的源字节和绝对消耗它们的任何接收器。
另一方面,文件中漏洞的位置是一种“旁道”信息,“经典”系统调用(例如 read(2)
)向用户隐藏了这些信息。io.Copy()
无法以任何方式传达此类边信道信息。
IOW,最初,文件稀疏性只是在用户背后高效存储数据的想法。
所以,不,io.Copy()
本身无法处理稀疏文件。
您需要更深入地使用 syscall
包和一些手动修补来实现所有这些。
要处理漏洞,您应该为 lseek(2)
系统调用使用 SEEK_HOLE
和 SEEK_DATA
特殊值,虽然正式非标准,由 all 支持major platforms .
不幸的是,不存在对那些“where”位置的支持既不在股票 syscall
包中(从 Go 1.8.1 开始)也不在 golang.org/x/sys
树。
但不要害怕,有两个简单的步骤:
首先,股票syscall.Seek()
实际上映射到lseek(2)
在相关平台上。
接下来,您需要计算出 SEEK_HOLE
的正确值,并且SEEK_DATA
用于您需要支持的平台。
Note that they are free to be different between different platforms!
比如说,在我的 Linux 系统上我可以做一些简单的事情
$ grep -E 'SEEK_(HOLE|DATA)' </usr/include/unistd.h
# define SEEK_DATA 3 /* Seek to next data. */
# define SEEK_HOLE 4 /* Seek to next hole. */
…计算出这些符号的值。
现在,比方说,你在你的包中创建了一个特定于 Linux 的文件包含类似的东西
// +build linux
const (
SEEK_DATA = 3
SEEK_HOLE = 4
)
然后将这些值与 syscall.Seek()
一起使用。
要传递给 syscall.Seek()
和 friend 的文件描述符可以使用 Fd()
方法从打开的文件中获取os.File
值。
读取时使用的模式是检测包含数据的区域,并从中读取数据——参见 this举个例子。
请注意,这涉及读取稀疏文件;但是如果你真的想将它们传输为稀疏的——也就是说,在保持它们的这个属性的情况下——情况就更复杂了:它似乎更不便携,所以一些研究和实验到期了。
在 Linux 上,您似乎可以尝试使用 fallocate(2)
和FALLOC_FL_PUNCH_HOLE | FALLOC_FL_KEEP_SIZE
尝试在您正在写入的文件的末尾;如果那合法地失败了(使用 syscall.EOPNOTSUPP
),您只需将您正在读取的漏洞所覆盖的尽可能多的归零 block 铲到目标文件中——希望如此操作系统会做正确的事情,并自行将它们变成一个洞。
请注意,一些文件系统根本不支持空洞——作为一个概念。一个例子是 FAT 家族中的文件系统。我要引导您的是,无法创建稀疏文件可能在您的情况下实际上是目标文件系统的属性。
您可能会找到 Go issue #13548 "archive/tar: add support for writing tar containing sparse files"引起兴趣。
请注意:您还可以考虑检查复制源文件的目标目录是否与源文件位于同一文件系统中,如果是这样,请使用 syscall.Rename()
(在 POSIX 系统上)或 os.Rename()
只在不同目录之间移动文件 w/o实际上是在复制它的数据。
关于file - io.Copy() 的稀疏文件很大,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/43035271/
我想知道是否可以访问放在 tomcat 的 conf 文件夹中的文件。通常我会在这个文件中放置多个 webapp 的配置,在 war 之外。 我想使用类路径独立于文件系统。 我过去使用过 lib 文件
我有一个 PowerShell 脚本,它获取文件列表并移动满足特定条件的文件。为什么即使对象为空,foreach 循环也会运行? 我假设如果 $i 不存在,它就不会运行。但是如果 $filePath
我已将 BasicAccountRule.drl 放置在我的 Web 应用程序中,位置为:C:/workspace/exim_design/src/main/resources/rules/drl/i
我使用 File.open('file.txt').class 和 File.open('file.txt').readlines.class 以及前者进行了检查一个返回 File,后者返回 Arra
我正在尝试使用 FileOutputStream 删除文件,在其中写入内容后。这是我用来编写的代码: private void writeContent(File file, String fileC
我正在尝试使用 flink 和 python 批处理 api 测试 Wordcount 经典示例。我的问题是,将数据源从 env.from_elements() 修改为 env.read_text()
我正在尝试制作一个可以同时处理多个不同文件的程序。我的想法是制作一个包含 20 个 FILE* 的数组,以便在我达到此限制时能够关闭其中一个并打开请求的新文件。 为此,我想到了一个函数,它选择一个选项
我有两个文件A和B文件A: 976464 792992 文件B TimeStamp,Record1,976464,8383,ABCD 我想搜索文件 A 和文件 B 中的每条记录并打印匹配的记录。打印的
我有一些保存在 map 中的属性文件。示例: Map map = new HashMap<>(); map.put("1", "One"); map.put("2", "Two"); map.put(
我正在尝试找出一个脚本文件,该文件接受一个包含文件列表的文件(每一行都是一个文件路径,即 path/to/file)并将它们合并到一个文件中。 例如: list.text -- path/to/fil
为了使用 File.CreateText() 和 File.AppendText() 你必须: 通过调用这些方法之一打开流 写消息 关闭流 处理流 为了使用 File.AppendAllText()
使用rsync时,如何在使用--files-from参数复制时重命名文件?我有大约190,000个文件,在从源复制到目标时,每个文件都需要重命名。我计划将文件列表放在一个文本文件中传递给--files
我在非服务器应用程序中使用 Spring(只需从 Eclipse 中某个类的 main() 编译并运行它)。 我的问题是作为 new FileSystemXmlApplicationContext 的
QNX (Neutrino 6.5.0) 使用 ksh 的开源实现作为其 shell 。许多提供的脚本,包括系统启动脚本,都使用诸如 if ! test /dev/slog -ef /dev/slog
当我尝试打开从我的应用程序下载的 xls 文件时,出现此错误: excel cannot open the file because the file format or file extension
有一些相关的概念,即文件指针、流和文件描述符。 我知道文件指针是指向数据类型 FILE 的指针(在例如 FILE.h 和 struct_FILE.h 中声明)。 我知道文件描述符是 int ,例如成员
好吧,这应该很容易... 我是groovy的新手,我希望实现以下逻辑: def testFiles = findAllTestFiles(); 到目前为止,我想出了下面的代码,该代码可以成功打印所有文
我理解为什么以下内容会截断文件的内容: Get-Content | Out-File 这是因为 Out-File 首先运行,它会在 Get-Content 有机会读取文件之前清空文件。 但是当我尝
您好,我正在尝试将文件位置表示为变量,因为最终脚本将在另一台机器上运行。这是我尝试过的代码,然后是我得到的错误。在我看来,python 是如何添加“\”的,这就是导致问题的原因。如果是这种情况,我如何
我有一个只包含一行的输入文件: $ cat input foo bar 我想在我的脚本中使用这一行,据我所知有 3 种方法: line=$(cat input) line=$( input"...,
我是一名优秀的程序员,十分优秀!