- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个 261MB 的文本文件(xdebug 输出),当我在其中读取它时,它占用了额外的 2GB 空间动态空间。
(defun stream->string (tmp-stream)
(do ((line (read-line tmp-stream nil nil)
(read-line tmp-stream nil nil))
(lines nil))
((not line) (progn
(FORMAT T "COLLECTED~%")
(FORMAT nil "~{~a~^~%~}" (reverse lines))))
(push line lines)))
(defparameter *test* nil)
(progn
(setf *test* nil)
(sb-ext:gc :full t)
(room)
(FORMAT T "----~%")
(with-open-file (stream "/home/.../debugFiles/xdebug_1.xt")
(room)
(FORMAT T "----~%")
(setf *test* (stream->string stream))
(sb-ext:gc :full t)
(room)
(FORMAT T "----~%"))
(sb-ext:gc :full t)
(room))
输出
Dynamic space usage is: 84,598,224 bytes.
Read-only space usage is: 5,856 bytes.
Static space usage is: 4,160 bytes.
Control stack usage is: 8,408 bytes.
Binding stack usage is: 1,072 bytes.
Control and binding stack usage is for the current thread only.
Garbage collection is currently enabled.
Breakdown for dynamic space:
20,841,808 bytes for 20,691 code objects.
15,989,600 bytes for 999,350 cons objects.
14,532,960 bytes for 118,880 simple-vector objects.
13,951,792 bytes for 168,301 instance objects.
5,994,864 bytes for 41,648 simple-character-string objects.
13,287,200 bytes for 215,901 other objects.
84,598,224 bytes for 1,564,771 dynamic objects (space total.)
----
Dynamic space usage is: 85,346,752 bytes.
Read-only space usage is: 5,856 bytes.
Static space usage is: 4,160 bytes.
Control stack usage is: 8,536 bytes.
Binding stack usage is: 1,072 bytes.
Control and binding stack usage is for the current thread only.
Garbage collection is currently enabled.
Breakdown for dynamic space:
20,842,928 bytes for 20,692 code objects.
16,125,008 bytes for 1,007,813 cons objects.
14,698,784 bytes for 120,834 simple-vector objects.
14,239,440 bytes for 171,411 instance objects.
6,014,144 bytes for 41,776 simple-character-string objects.
13,426,448 bytes for 219,723 other objects.
85,346,752 bytes for 1,582,249 dynamic objects (space total.)
----
COLLECTED
Dynamic space usage is: 2,557,851,296 bytes.
Read-only space usage is: 5,856 bytes.
Static space usage is: 4,160 bytes.
Control stack usage is: 8,536 bytes.
Binding stack usage is: 1,072 bytes.
Control and binding stack usage is for the current thread only.
Garbage collection is currently enabled.
Breakdown for dynamic space:
2,466,544,480 bytes for 817,255 simple-character-string objects.
91,306,816 bytes for 2,303,370 other objects.
2,557,851,296 bytes for 3,120,625 dynamic objects (space total.)
----
Dynamic space usage is: 1,131,069,056 bytes.
Read-only space usage is: 5,856 bytes.
Static space usage is: 4,160 bytes.
Control stack usage is: 8,360 bytes.
Binding stack usage is: 1,072 bytes.
Control and binding stack usage is for the current thread only.
Garbage collection is currently enabled.
Breakdown for dynamic space:
1,053,183,424 bytes for 41,547 simple-character-string objects.
77,885,632 bytes for 1,510,521 other objects.
1,131,069,056 bytes for 1,552,068 dynamic objects (space total.)
我能理解大小的三倍(尽管这仍然会让我感到惊讶):
*test*
中保存的字符串>但是,增加 10 倍就太大了。
怎么会这样?
最佳答案
正如 Rainer 指出的那样,您的问题是 sbcl 将 string
表示为 utf32 代码点的向量,这意味着每个字符都是 32 位。
理想情况下,处理文件的正确方法是逐行处理它们,而不是将它们全部放入内存中,但如果这不是您的选择,并且您确信每个角色在您的文件中是一个 base-char
即 ascii 字符,您可以将 :element-type 'base-char
传递给 with-open-file
,并将 read-line
的结果强制
为simple-base-string
。这可能看起来像:
(defun file->lines (path)
(with-open-file (stream path :element-type 'base-char)
(do ((line (read-line stream nil nil)
(read-line stream nil nil))
(lines nil))
((not line) (nreverse lines))
(push (coerce line 'simple-base-string) lines))))
另外请注意,如果您的文件有很多行,那么将这些行存储在链表中的开销可能会很大。如果您可以预测文件中的行数,则预分配一个大向量并将行存储在其中可能会有更好的性能,例如:
(defun file->lines (path number-of-lines)
(with-open-file (stream path :element-type 'base-char)
(do ((line (read-line stream nil nil)
(read-line stream nil nil))
(lines (make-array number-of-lines :fill-pointer 0)))
((not line) lines)
(vector-push (coerce line 'simple-base-string) lines))))
但要确保您的number-of-lines
被高估了,否则您可能不得不进行缓慢的重新分配和复制。 (这就是为什么我写 vector-push
而不是 vector-push-extend
的原因。
如果您无法预测多行,您可能最好读入一个列表,然后在末尾强制转换为向量,例如:
(defun file->lines (path)
(with-open-file (stream path :element-type 'base-char)
(do ((line (read-line stream nil nil)
(read-line stream nil nil))
(lines nil))
((not line) (coerce (nreverse lines) 'vector))
(push (coerce line 'simple-base-string) lines))))
关于string - 大小爆炸文件与字符串,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/40158743/
这个问题在这里已经有了答案: C sizeof a passed array [duplicate] (7 个回答) 8年前关闭。 在一个函数中,我声明了一个数组: int char_count_ar
简而言之,文件系统如何与 block 设备通信? 最佳答案 我对 block 大小不太了解。我认为 ext4(Linux)的文件系统的 block 大小是 4KB,考虑到现代处理器的页面大小(4KB)
我知道 tinyint(1) 和 tinyint(2) 具有相同的存储空间范围。 唯一的区别是显示宽度不同。这是否意味着 tinyint(1) 将存储所有类型的整数但只正确显示 0 到 9 的范围?而
今晚我已经研究了以下代码几个小时,但我只是摸不着头脑。 当使用函数从标准输入填充数组时,我不断收到“大小 8 的无效写入”和“大小 8 的无效读取”。 如有任何帮助,我们将不胜感激...我知道 Sta
我有一个 valgrind 错误,我不知道如何摆脱它们: ==5685== Invalid read of size 8 ==5685== at 0x4008A1: main (in /home
我对 Hadoop 的概念有点困惑。 Hadoop block 大小、拆分大小和 block 大小 之间有什么区别? 提前致谢。 最佳答案 block 大小和 block 大小相同。 拆分大小 可能与
我想不出一个好的标题,所以希望可以。 我正在做的是创建一个离线 HTML5 webapp。 “出于某些原因”我不希望将某些文件放在缓存 list 中,而是希望将内容放在 localStorage 中。
无法将 xamarin apk 大小减少到 80 MB 以下,已执行以下操作: 启用混淆器 配置:发布 平台:事件(任何 CPU)。 启用 Multi-Dex:true 启用开发人员检测(调试和分析)
我正在开发一个程序,需要将大量 csv 文件(数千个)加载到数组中。 csv 文件的尺寸为 45x100,我想创建一个尺寸为 nx45x100 的 3-d 数组。目前,我使用 pd.read_csv(
Hello World 示例的 React Native APK 大小约为 20M (in recent versions),因为支持不同的硬件架构(ARMv7、ARMv8、X86 等),而同一应用程
我有一个包含 n 个十进制元素的列表,其中每个元素都是两个字节长。 可以说: x = [9000 , 5000 , 2000 , 400] 这个想法是将每个元素拆分为 MSB 和 LSB 并将其存储在
如何设置 GtKTextView 的大小?我想我不能使用 gtk_widget_set_usize。 最佳答案 您不能直接控制小部件的大小,而是由其容器完成。您可以使用 gtk_widget_set_
这个问题在这里已经有了答案: c++ sizeof() of a class with functions (7 个答案) 关闭 5 年前。 结果是 12。 foobar 函数存储在内存中的什么位置
当我在 ffmpeg(或任何其他程序)中使用这样的命令时: ffmpeg -i input.mp4 image%d.jpg 所有图像的组合文件大小总是比视频本身大。我尝试减少每秒帧数、降低压缩设置、模
我是 clojurescript 的新手。 高级编译后出现“77 KB”的javascript文件是否正常? 我有一个 clojurescript 文件: 我正在使用 leinigen: lein c
我想要一个 QPixmap尺寸为 50 x 50。 我试过 : QPixmap watermark(QSize(50,50)); watermark.load(":/icoMenu/preparati
我正在尝试从一篇研究论文中重新创建一个 cnn,但我对深度学习还是个新手。 我得到了一个大小为 32x32x7 的 3d 补丁。我首先想执行一个大小为 3x3 的卷积,具有 32 个特征和步幅为 2。
我一直在尝试调整 View Controller 内的 View 大小,但到目前为止没有运气。基本上,我的 View 最底部有一个按钮,当方向从纵向更改为横向时,该按钮不再可见,因为它现在太靠下了。
如何使用此功能检查图像的尺寸?我只是想在上传之前检查一下... $("#LINK_UPLOAD_PHOTO").submit(function () { var form = $(this);
我用 C++ 完成了这个,因为你可以通过引用传递参数。我无法弄清楚如何在 JavaScript 中执行此操作。我的代码需要更改什么?我的输出是1 this.sizeOfBst = function()
我是一名优秀的程序员,十分优秀!