- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在尝试优化一些代码,使用标准来尝试比较,例如添加INLINE
的效果一个函数的编译指示。但我发现重新编译/运行的结果不一致。
我需要知道如何使结果在运行中保持一致以便我可以比较它们,或者如何评估基准是否可靠,即(我猜)如何解释有关方差的细节,“时钟调用”等。
我的特殊情况的详细信息
这与我上面的主要问题是正交的,但在我的特定情况下,有几件事可能会导致不一致:
IO
使用 whnfIO
的操作因为使用 whnf
的方法在 this example没有用。 ghc --make -fforce-recomp -threaded -O2 Benchmark.hs
estimating clock resolution...
mean is 16.97297 us (40001 iterations)
found 6222 outliers among 39999 samples (15.6%)
6055 (15.1%) high severe
estimating cost of a clock call...
mean is 1.838749 us (49 iterations)
found 8 outliers among 49 samples (16.3%)
3 (6.1%) high mild
5 (10.2%) high severe
benchmarking actors/insert 1000, query 1000
collecting 100 samples, 1 iterations each, in estimated 12.66122 s
mean: 110.8566 ms, lb 108.4353 ms, ub 113.6627 ms, ci 0.950
std dev: 13.41726 ms, lb 11.58487 ms, ub 16.25262 ms, ci 0.950
found 2 outliers among 100 samples (2.0%)
2 (2.0%) high mild
variance introduced by outliers: 85.211%
variance is severely inflated by outliers
benchmarking actors/insert 1000, query 100000
collecting 100 samples, 1 iterations each, in estimated 945.5325 s
mean: 9.319406 s, lb 9.152310 s, ub 9.412688 s, ci 0.950
std dev: 624.8493 ms, lb 385.4364 ms, ub 956.7049 ms, ci 0.950
found 6 outliers among 100 samples (6.0%)
3 (3.0%) low severe
1 (1.0%) high severe
variance introduced by outliers: 62.576%
variance is severely inflated by outliers
estimating clock resolution...
mean is 51.46815 us (10001 iterations)
found 203 outliers among 9999 samples (2.0%)
117 (1.2%) high severe
estimating cost of a clock call...
mean is 4.615408 us (18 iterations)
found 4 outliers among 18 samples (22.2%)
4 (22.2%) high severe
benchmarking actors/insert 1000, query 1000
collecting 100 samples, 1 iterations each, in estimated 38.39478 s
mean: 302.4651 ms, lb 295.9046 ms, ub 309.5958 ms, ci 0.950
std dev: 35.12913 ms, lb 31.35431 ms, ub 42.20590 ms, ci 0.950
found 1 outliers among 100 samples (1.0%)
variance introduced by outliers: 84.163%
variance is severely inflated by outliers
benchmarking actors/insert 1000, query 100000
collecting 100 samples, 1 iterations each, in estimated 2644.987 s
mean: 27.71277 s, lb 26.95914 s, ub 28.97871 s, ci 0.950
std dev: 4.893489 s, lb 3.373838 s, ub 7.302145 s, ci 0.950
found 21 outliers among 100 samples (21.0%)
4 (4.0%) low severe
3 (3.0%) low mild
3 (3.0%) high mild
11 (11.0%) high severe
variance introduced by outliers: 92.567%
variance is severely inflated by outliers
最佳答案
虽然这里肯定没有足够的信息来查明每个问题,但我有一些建议可能会有所帮助。
解释标准结果
被识别为异常值的样本的问题在于,该标准无法真正判断它们是否是异常值,因为它们是垃圾数据,或者它们是否是由于某种合法原因而不同的有效数据。它可以强烈暗示它们是垃圾(“方差严重膨胀”这一行),但这真正意味着您需要调查您的测试环境、您的测试或您的应用程序本身,以确定异常值的来源。在这种情况下,它几乎肯定是由系统负载引起的(基于您提供的其他信息)。
您可能有兴趣阅读 BOS 的 announcement of criterion ,它更详细地解释了它的工作原理,并通过一些示例来说明系统负载如何影响基准测试过程。
我非常怀疑“时钟调用的估计成本”的差异。请注意,异常值的比例很高(在两次运行中),并且这些异常值具有“高度严重”的影响。我将这解释为意味着所选择的时钟计时标准是垃圾(可能在两次运行中),使其他一切也不可靠。正如@DanielFischer 所建议的那样,关闭其他应用程序可能有助于解决这个问题。最坏的情况可能是硬件问题。如果您关闭所有其他应用程序并且时钟计时仍然不可靠,您可能需要在另一个系统上进行测试。
如果您在同一系统上运行多个测试,则每次运行的时钟时序和成本应该相当一致。如果不是,则说明时间会受到影响,从而导致数据不可靠。
除此之外,这里有两个随机的想法可能是一个因素。
CPU负载
线程运行时可能对 CPU 负载很敏感。默认 RTS 值适用于许多应用程序,除非您的系统负载很重。问题是垃圾收集器中有一些临界区,所以如果 Haskell 运行时资源匮乏(因为它与其他应用程序竞争 CPU 或内存),所有进程都可能被阻塞,等待这些部分。我已经看到这对性能的影响是 2.5 倍,这或多或少与您看到的三倍差异一致。
即使垃圾收集器没有问题,来自其他应用程序的高 CPU 负载也会影响您的结果,应尽可能消除。
如何诊断
top
或其他系统实用程序来检查 CPU 负载。 +RTS -s
.在静态的底部,寻找这些行 gc_alloc_block_sync: 0
whitehole_spin: 0
gen[0].sync: 0
gen[1].sync: 0
+RTS -N6
或 +RTS -N7
在 8 核机器上)+RTS -qg
)。与禁用并行收集器相比,我通常通过保留空闲内核获得更好的结果,但是 YMMV。 lsof
可以帮助追踪神秘的 I/O 性能 关于haskell - 如何获得一致的标准基准,或跨运行解释结果?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/11712234/
我最近在读 CSAPP。在 10.9 节中,它说标准 I/O 不应该与 socket 一起使用,原因如下: (1) The restrictions of standard I/O Restricti
似乎是一个足够标准的问题,可以保证解决方案中的标准设计: 假设我想在文件中写入 x+2(或更少)个字符串。 x 字符串构成一个部分的内容,这两个字符串构成该部分的页眉和页脚。要注意的是,如果内容中没有
代码版本管理 在项目中,代码的版本管理非常重要。每个需求版本的代码开发在版本控制里都应该经过以下几个步骤。 在master分支中拉取该需求版本的两个分支,一个feature分支,
我有以下sql查询,我需要获取相应的hibernate条件查询 SELECT COUNT(DISTINCT employee_id) FROM erp_hr_payment WHERE payment
所以我正在编写一些代码,并且最近遇到了实现一些 mixin 的需要。我的问题是,设计混音的正确方法是什么?我将使用下面的示例代码来说明我的确切查询。 class Projectile(Movable,
我的环境变量包含如下双引号: $echo $CONNECT_SASL_JAAS_CONFIG org.apache.kafka.common.security.plain.PlainLoginModu
示例: /** * This function will determine whether or not one string starts with another string. * @pa
有没有办法在 Grails 中做一个不区分大小写的 in 子句? 我有这个: "in"("name", filters.tags) 我希望它忽略大小写。我想我可以做一个 sqlRestriction
我搜索了很长时间,以查找将哪些boost库添加到std库中,但是我只找到了一个新库的完整列表(如此处:http://open-std.org/jtc1/sc22/wg21/docs/library_t
我已经通过使用这个肮脏的黑客解决了我的问题: ' Filter managerial functions ActiveSheet.Range("$A$1:$BW$2211").Auto
因此,我很难理解我需要遵循的标准,以便我的 Java 程序能够嵌入 HTML。我是否只需将我的主类扩展到 Applet 类,或者我还需要做更多的事情吗?另外,在我见过的每个 Applet 示例中,它都
我对在 Hibernate 中使用限制有疑问。 我必须创建条件,设置一些限制,然后选择日期字段最大值的记录: Criteria query = session.createCriteria(Stora
我有标准: ICriteria criteria = Session.CreateCriteria() .SetFetchMode("Entity1", FetchMo
我很难编写条件来选择所有子集合或孙集合为空的实体。我可以将这些作为单独的条件来执行,但我无法将其组合成一个条件。 类结构: public class Component { p
@Entity class A { @ManyToMany private List list; ... } @Entity class B { ... } 我想使用条件(不是 sql 查询)从 A
我的数据库中有以下表结构: Table A: Table B: Table C: _______________
请帮助我: 我有下一张 table : 单位 ID 姓名 用户 ID 姓名 利率 单位 ID 用户 ID 我不明白如何从 SQL 创建正确的条件结构: 代码: SELECT * FROM Unit W
我正在构建一个包含项目的网站,每个项目都有一个页面,例如: website.com/book/123 website.com/film/456 website.com/game/789 每个项目都可以
我需要使用两个属性的组合来过滤结果列表。一个简单的 SQL 语句如下所示: SELECT TOP 10 * FROM Person WHERE FirstName + ' ' + LastName L
我有一个“ super 实体”SuperEntity 和三个扩展父类(super class)的实体 ChildEntity1、...、ChildEntity3。 搜索数据库中的所有实体很容易,即我们
我是一名优秀的程序员,十分优秀!