- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
这实际上是this的后续问题问题。我设法让分析工作正常进行,问题似乎确实是懒惰的评估。
我使用的数据结构是Map Int (Map Int Text)
,其中Text
来自Data.Text 。问题是,构建这个 map 的函数会产生一个巨大的重击。处理大约 3 MB 的输入文本时,程序需要超过 250 MB 的内存。
现在讨论这个问题的真正目的:
要获取此数据结构中的字符数,请使用以下函数:
type TextResource = M.Map Int (M.Map Int T.Text)
totalSize :: TextResouce -> Int
totalSize = M.fold ((+) . (M.fold ((+). T.length) 0)) 0
不漂亮,但它完成了工作。我在创建 TextResource 后立即在主函数中使用此函数。有趣的是,当我使用 RTS 选项 -hr
或 -hc
分析程序时,一段时间后内存使用量下降到 70 或 50 MB,这那就完全没问题了。
不幸的是,这仅在使用分析选项和 totalSize
函数时才有效 - 如果没有它们,它会回到 250 MB。
我上传了程序(< 70行)以及测试文件和cabal文件,以便您可以自己尝试一下:Link
test.xml是生成的XML文件,应将其放入可执行文件目录中。要构建,cabal configure --enable-executable-profiling
和之后的 cabal build
应该足够了(如果您安装了所需库的分析版本)。
使用+RTS -hc
运行程序一次和不使用+RTS -hc
运行程序一次时,您可以看到变化。
如果有人可以运行该程序,我会非常高兴,因为我真的被困在这里了。我已经尝试在几个地方放入deepseq,但没有任何效果(嗯,除了使用分析选项之外)。
编辑:
Profiling does show, however, that only ~20MB of the heap is used, so as in my comment, I blame GHC for not freeing as much of the GC nursery memory as you seem to want.
谢谢,这为我指明了正确的方向。事实证明,您可以告诉 GHC 执行垃圾收集 ( performGC ),在对 map 进行深度搜索后,效果非常好。尽管我猜想不推荐使用performGC,但它似乎是适合这里工作的工具。
编辑2:这就是我更改 main 函数的方式(+ deepseqing buildTextFile 的返回):
main = do tf <- buildTextFile "test.xml"
performGC
putStrLn . show . text 1 1000 $ tf
getLine
putStrLn . show . text 100 1000 $ tf
return ()
最佳答案
The problem is, that the function which builds this map creates a huge thunk.
没有。基于堆分析,我不认为空间使用是重击。另外,我用严格的 HashMap 替换了 Data.Map,并强制映射(以避免创建大的重击)具有相同的结果。
when I profile the program by using the RTS option -hr or -hc the memory usage goes down to 70 or 50 MB after a while
我无法重现这个。使用 -hr
、-hy
或 -hc
进程会保留 140MB 堆。然而,分析确实表明只使用了大约 20MB 的堆,因此正如我在评论中所说,我责怪 GHC 没有释放您想要的那么多 GC 苗圃内存。
对于计算过程中的高内存使用,上面的-hy
配置文件显示大部分内存是由于String
类型和HaXML库Posn
类型。我将重申我的建议,即寻找一个基于 ByteString
或 Text
的 XML 库,该库更注重资源(xml-enumerator?)。
关于haskell - 内存分析会改变内存使用情况(变得更好),我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/6878334/
据我所知,根本不为元素呈现 HTML,或添加 display:none,似乎具有完全相同的行为:两者都使元素消失并且不与 HTML 交互。 我正在尝试禁用和隐藏一个复选框。所以HTML的总量很小;我无
我刚刚读了Android Architecture Tutorial: Developing an App with a Background Service (using IPC) .基本上是 让服
我有两个查询具有相同的结果,现在我想知道哪个查询更优化? 在选择中: select t1.*, sum(t2.value) as total_votes from table1 t1 left joi
有人告诉我,对于 I/O 绑定(bind)的应用程序,非阻塞 I/O 会更好。对于 CPU 密集型应用程序,阻塞 I/O 会好得多。我找不到这种说法的原因。试过谷歌,但很少有文章只是触及这个话题而没有
我有一个算法可以在数字列表中寻找好的对。一个好的配对被认为是索引 i 小于 j 且 arr[i] 1: # Finding the mid of the array
我有一个算法可以在数字列表中寻找好的对。一个好的配对被认为是索引 i 小于 j 且 arr[i] 1: # Finding the mid of the array
我从 API 收到一个 json,我需要解析并修改一个属性值。问题是,我收到的 json 数据的嵌套结构不一致,我无法控制它。 这将禁止我指定在特定深度(如 parsedJson.children[0
我有 451 个城市的坐标。现在我想计算每个城市之间的距离,然后根据该距离对一些结果进行排序。现在我有两个选择: 我可以运行一个循环来计算每个可能的城市组合的距离并将它们存储到一个表中,这将产生大约
对于返回相同结果的不同查询,我有两个查询计划我想知道是否有人可以告诉我哪个“更好”,以及为什么。 SELECT * FROM bids order by (select ranking from us
关闭。这个问题需要更多focused .它目前不接受答案。 想改进这个问题吗? 更新问题,使其只关注一个问题 editing this post . 关闭 7 年前。 Improve this qu
我有一个二维数组。我需要尽可能快地对其执行一些操作(函数每秒将被调用十几次,所以让它变得高效会很好)。 现在,假设我想获取元素 A[i][j],简单地使用 A[i][j] 在速度上有什么不同吗和 *(
在声明或使用字符串的代码中,我通常会看到开发人员这样声明它: string randomString = @"C:\Random\RandomFolder\ThisFile.xml"; 代替: str
这个问题在这里已经有了答案: 关闭 10 年前。 Possible Duplicate: Why don't CSS resets use '*' to cover all elements? 我正
如果我有一个包含许多重复项的 python 列表,并且我想遍历每个项目,而不是重复项,最好使用一个集合(如 set(mylist),或者找到另一种方法来创建没有重复的列表?我想只是循环遍历列表并检查重
在阅读常量接口(interface)反模式时,我发现没有实例的最终常量类比常量接口(interface)更好。 请解释一下怎么做? public interface ConstIfc { publ
我正在查看我继承的一些旧代码,我真的不喜欢某些地方的风格。我真的不喜欢它的外观的一件事是: bool func() { bool ret = true; ret &= test1();
关闭。这个问题是opinion-based 。目前不接受答案。 想要改进这个问题吗?更新问题,以便 editing this post 可以用事实和引文来回答它。 . 已关闭 4 年前。 Improv
我经常发现自己试图使用 boost/QT 信号解耦对象。实现这一点的简单方法是针对我要通信的每个具体类型,创建一个新的信号和插槽签名并连接所有相关对象。这导致了访问者模式,理想情况下我想发出一个访问者
我正在 https://docs.oracle.com/javase/tutorial/java/javaOO/lambdaexpressions.html 上阅读有关 lambda 的内容 在方法
public List getInts() { List xs = new ArrayList(); xs.add(1); // return Collections.unmo
我是一名优秀的程序员,十分优秀!