performance - Haskell 的严格折叠真的使用线性空间吗？-6ren

performance - Haskell 的严格折叠真的使用线性空间吗？

转载作者：行者123 更新时间：2023-12-05 00:53:04

25

4

我以为我了解了 Haskell 中折叠性能的基础知识，如 foldr, foldl, foldl' on the Haskell Wiki 中所述和许多其他地方。特别是，我了解到对于累积函数，应该使用 foldl'，以避免空间泄漏，并且编写标准库函数就是为了尊重这一点。所以我假设像 length 这样的简单累加器，应用于像 replicate n 1 这样的简单列表，应该在列表的长度中需要恒定的空间(或至少是次线性的) .我的直觉是，在足够简单的列表上，它们的行为大致类似于命令式语言中的 for 循环。

但今天我发现这在实践中似乎并不成立。例如，length $ replicate n 1 似乎在 n 中使用空间线性。 在 ghci 中:

ghci> :set +s
ghci> length $ replicate (10^6) 1
1000000
(0.02 secs, 56,077,464 bytes)
ghci> length $ replicate (10^7) 1
10000000
(0.08 secs, 560,078,360 bytes)
ghci> length $ replicate (10^8) 1
100000000
(0.61 secs, 5,600,079,312 bytes)
ghci> length $ replicate (10^9) 1
1000000000
(5.88 secs, 56,000,080,192 bytes)

简而言之，我的问题是:length 和其他严格折叠真的使用线性空间吗？如果是这样，为什么？这是不可避免的吗？下面是我如何尝试理解这一点的更多细节，但它们可能不值得一读 - tl;dr 是线性空间的使用似乎会持续任何变化我试试。

(我最初使用 sum 作为示例函数。正如 Willem Van Onsem 指出的那样，这是一个选择不当的示例，因为默认实例实际上并不严格。但是，主要问题仍然存在，因为如下所述，这种情况发生在许多其他真正基于严格折叠的函数中。)

将 length 替换为 foldl' (\n _ -> n+1) 0 似乎会使性能下降一个常数因子；空间使用似乎仍然是线性的。
用 foldl 和 foldr 定义的版本的内存使用率更差(正如预期的那样)，但只是一个小的常数因素，而不是渐近更差的(正如大多数讨论所暗示的那样)。
将 length 替换为 sum、last 或其他简单的累加器，或者使用 foldl'，似乎也没有改变线性空间使用情况。
使用 [1..n] 作为测试列表，以及其他类似的变体，似乎也没有显着差异。
在Data.Foldable中的sum、foldl'等通用版本之间切换，Data.列表，以及直接通过模式匹配定义的本地版本，似乎也没有什么区别。
编译而不是在 ghci 中工作似乎也只能通过一个常数因子来提高空间使用率。
在 GHC 的几个最新版本(8.8.4、8.10.5 和 9.0.1)之间切换似乎也没有显着差异。

最佳答案

“他们是否使用线性空间”是一个有点不清楚的问题。通常当我们谈论算法使用的空间时，我们谈论的是它的工作集:它一次需要的最大内存量。 “如果我的电脑只有 X 字节的内存，我可以运行这个程序吗？”但这不是 GHCI 的 :set +s 措施。它测量所有内存分配的总和，包括中途清理的内存分配。在你的实验中，内存的最大用途是什么？当然是列表本身。

所以您实际上只是测量了大小为 N 的列表占用的字节数。您可以通过使用 last 而不是 length 来确认这一点，我希望您同意不分配中间结果，并且是严格的。使用度量标准时，它占用与 length 相同的内存量 - length 不会为总和分配额外的内存。

但更大的问题是 GHCI 不是优化编译器。如果您完全关心性能特征，那么 GHCI 是错误的工具。相反，使用带有 -O2 的 GHC，并打开 GHC 的分析器。

import System.Environment (getArgs)

main = do
  n <- read . head <$> getArgs
  print $ length (replicate (10^n) 1)

并运行它:

$ ghc -O2 -prof -fprof-auto stackoverflow.hs
$ ./stackoverflow 6 +RTS -p
1000000
$ grep "total alloc" stackoverflow.prof
    total alloc =      54,856 bytes  (excludes profiling overheads)
$ ./stackoverflow 9 +RTS -p
1000000000
$ grep "total alloc" stackoverflow.prof
    total alloc =      55,008 bytes  (excludes profiling overheads)

我们可以看到，尽管输入大小增加了一千倍，但空间使用量大致保持不变。

Will Ness 是否正确指出 in a comment -s 将是比 -p 更好的测量工具。

关于performance - Haskell 的严格折叠真的使用线性空间吗？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/68534179/

25

4

0

文章推荐： c++ - 如何将度数转换为弧度？

文章推荐： reactjs - 退出动画在下一个 js 成帧器 Action 中不起作用？

文章推荐： r - 清除 RStudio 中整个 RMarkdown (Rmd) 文档的当前输出？

opengl - 线性/非线性纹理映射扭曲的四边形
在我的 previous question ，已经确定，当纹理四边形时，面部被分解为三角形，纹理坐标以仿射方式插值。不幸的是，我不知道如何解决这个问题。 provided link很有用，但没有达到
Qt运动(线性)模糊
是否有简单的解决方案可以在 Qt 中为图像添加运动模糊？还没有找到任何关于模糊的好教程。我需要一些非常简单的东西，我可以理解，如果我可以改变模糊角度，那就太好了。最佳答案 Qt 没有运动模糊过滤器。
javascript - 线性+阈值统一尺度
我想构建一个有点复杂的轴，它可以处理线性数据到像素位置，直到某个值，在该值中所有内容都被归入一个类别，因此具有相同的数据到像素值。例如，考虑具有以下刻度线的 y 轴: 0%, 10%, 20%, 30
android - 线性、可滚动布局中的基线约束
我需要确保两个 View 元素彼此相邻且垂直高度相同。我会使用基线约束来做到这一点，但目前我正在使用线性、可滚动的布局( ScrollView 中的线性布局)，当我点击一个元素时，它不允许我从中获取基
regex - 如何在非贪婪的正则表达式中避免(线性)回溯？
考虑正则表达式 ".*?\s*$" 和一个不以空格结尾的字符串。示例 " a" .最后\s永远无法匹配 a这就是为什么匹配器迭代: \s\s\s\s\s - fails .\s\s\
approximation - 插值建议(线性，三次？)
Closed. This question needs to be more focused。它当前不接受答案。想要改善这个问题吗？更新问题，使它仅关注editing this post的一个问题。
assembly - 线性、物理、逻辑和虚拟内存地址有什么区别？
我正在尝试阅读英特尔软件开发人员手册以了解操作系统的工作原理，这四个寻址术语让我感到困惑。以上是我的理解，如有不对请指正。线性地址 : 对一个孤立的程序来说，似乎是一长串以地址0开头的内存。该程序的
javascript - 检查数字表达式(线性)是否有效？
有很多方法可以使用正则表达式并相应地使用匹配/测试匹配来检查字符串是否有效。我正在检查包含字母(a-b)、运算符(+、-、/、*)、仅特殊字符(如(')'、'(')和数字(0-9)的表达式是否有效我
r - 线性 SVM 和提取权重
我正在使用 iris 数据集在 R 中练习 SVM，我想从我的模型中获取特征权重/系数，但我想我可能误解了一些东西，因为我的输出给了我 32 个支持向量。假设我要分析四个变量，我会得到四个。我知道在使
r - 线性 SVM 和提取权重
我正在使用 iris 数据集在 R 中练习 SVM，我想从我的模型中获取特征权重/系数，但我想我可能误解了一些东西，因为我的输出给了我 32 个支持向量。假设我要分析四个变量，我会得到四个。我知道在使
java - 如何在android中滑动布局(线性/相对..)
如何向左或向右滑动线性布局。在该线性布局中，默认情况下我有一个不可见的删除按钮，还有一些其他小部件，它们都是可见状态，当向左滑动线性布局时，我需要使其可见的删除按钮，当向右滑动时，我需要隐藏该删除按钮
r - 线性 SVM 中的错误预测
我正在编写一个 R 脚本，运行时会给出因变量的预测值。我的所有变量都被分类(如图所示)并分配了一个编号，总类数为101。(每个类是歌曲名称)。所以我有一个训练数据集，其中包含 {(2,5,6,1)8
java - 线性 RGB 空间中的仿射变换
如果源栅格位于 linear RGB color space使用以下 Java 代码进行转换，应用过滤器时(最后一行)会引发 java.awt.image.ImagingOpException: Un
ios - UIVIew animateWithDuration 线性？
我想为我的多个 UIImageView 设置动画，使其从 A 点线性移动到 B 点。我正在使用 options:UIViewAnimationOptionCurveLinear - Apple 文档
css - 线性，右渐变到透明渐变，底部有额外渐变
我第一次无法使用 CSS3 创建好看的渐变效果。右侧应该有从黑色到透明的渐变透明渐变。底部是页脚，所以它需要在底部另外淡化为透明。如果可能的话，一个例子: 页面的背景是一张图片，所以不可能有非透明淡
c++ - 线性(超定)代数方程的解
我有一组线性代数方程，Ax=By。其中A是36x20的矩阵，x是20x1的 vector ，B是36x13，y是13x1。排名(A)=20。因为系统是超定的，所以最小二乘解是可能的，即； x = (
Python 将每月值插入每日值(线性): Pandas
我有一个带有年月数据列(yyyymm)的 Pandas 数据框。我计划将数据插入每日和每周值。下面是我的 df。 df: 201301 201302 201303
python - 线性 N 次等式问题的最小二乘法
假设我想找到2条任意高维直线的“交点”。这两条线实际上不会相交，但我仍然想找到最相交的点(即尽可能靠近所有线的点)。假设这些线有方向向量A、B和初始点C、D，我可以通过简单地设置一个线性最小二乘问题
java - 线性 "smoothed"函数使用查找表
如果我想编写一个函数(可能也是一个类)，它从不可变的查找表(调用构造函数时固定)返回线性“平滑”数据，如下所示: 例如func(5.0) == 0.5。存储查找表的最佳方式是什么？我正在考虑使用两
python - 线性 X 对数刻度
给定一条线 X像素长如: 0-------|---V---|-------|-------|-------max 如果0 <= V <= max , 线性刻度 V位置将是 X/max*V像素。如何计

首页

博学

6Ren·AI

商城

performance - Haskell 的严格折叠真的使用线性空间吗？