- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
如何用 Java 编写(并运行)正确的微基准测试?
我正在寻找一些代码示例和注释来说明需要考虑的各种问题。
示例:基准测试应该测量时间/迭代还是迭代/时间,为什么?
最佳答案
有关编写微基准测试的技巧 from the creators of Java HotSpot :
规则 0:阅读有关 JVM 和微基准测试的权威论文。一个好的是 Brian Goetz, 2005 。不要对微基准抱有太大期望;它们仅测量有限范围的 JVM 性能特征。
规则 1: 始终包含一个自始至终运行测试内核的预热阶段,足以在计时阶段之前触发所有初始化和编译。 (在预热阶段,较少的迭代是可以的。经验法则是内循环迭代数万次。)
规则 2:始终使用 -XX:+PrintCompilation
、-verbose:gc
等运行,以便您可以验证编译器和 JVM 的其他部分在计时阶段不会执行意外的工作。
规则 2.1:在计时和预热阶段的开始和结束时打印消息,以便您可以验证规则 2 在计时阶段没有输出。
规则 3: 请注意 -client
和 -server
以及 OSR 和常规编译之间的区别。 -XX:+PrintCompilation
标志报告 OSR 编译,并使用 at 符号表示非初始入口点,例如:Trouble$1::run @ 2(41 字节)
.如果您追求最佳性能,则优先选择服务器而不是客户端,优先选择常规而不是 OSR。
规则 4:注意初始化效果。不要在计时阶段首次打印,因为打印会加载并初始化类。不要在预热阶段(或最终报告阶段)之外加载新类,除非您专门测试类加载(在这种情况下仅加载测试类)。规则 2 是抵御此类影响的第一道防线。
规则 5: 注意去优化和重新编译的影响。不要在计时阶段第一次采用任何代码路径,因为编译器可能会根据之前根本不会使用该路径的乐观假设,垃圾并重新编译代码。规则 2 是抵御此类影响的第一道防线。
规则 6: 使用适当的工具来了解编译器的想法,并期望对其生成的代码感到惊讶。在形成关于什么使某些东西更快或更慢的理论之前,请亲自检查代码。
规则 7:减少测量中的噪音。在安静的机器上运行基准测试,并运行几次,丢弃异常值。使用 -Xbatch
将编译器与应用程序序列化,并考虑设置 -XX:CICompilerCount=1
以防止编译器与其自身并行运行。尽量减少GC开销,设置Xmx
(足够大)等于Xms
并使用UseEpsilonGC
如果有的话。
规则 8:使用基准测试库,因为它可能更有效,并且已经为此唯一目的进行了调试。如JMH , Caliper或Bill and Paul's Excellent UCSD Benchmarks for Java .
关于java - 如何用 Java 编写正确的微基准测试?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/56991047/
我正在阅读一些基准测试技巧,并在此站点上发现了一条提示“重新启动 MySQL 服务器以消除任何不需要的缓存因素”:http://blog.monitor.us/2012/09/the-gold-sta
关闭。这个问题不符合Stack Overflow guidelines .它目前不接受答案。 我们不允许提问寻求书籍、工具、软件库等的推荐。您可以编辑问题,以便用事实和引用来回答。 关闭 7 年前。
我在linux上测量cpu时间和排序算法的时间。我使用getrusage来测量cpu时间,并使用clock_gettime CLOCK_MONOTONIC来获取墙时间。尽管我注意到cpu时间大于墙上时
我可以阅读很多关于 OpenCL 的文章,它似乎是最有前途的(唯一的?)多架构库。 OpenCL应该是第一个并行架构编程标准,它最终会被大部分程序员采用。这很好,但是从 native 编程库迁移到 O
我想在不使用外部依赖项的情况下对一些 Lua 进行基准测试。我目前正在使用 os.clock: local function dummy() end local start = os.clock()
我对此很好奇。 我想检查哪个函数更快,所以我编写了一些代码并执行了很多次。 public static void main(String[] args) { long ts;
有没有办法在项目的开发阶段对 SQL 查询进行基准测试? 有问题的表中只有几个示例行,但我想在行数达到数千、数百万、数十亿、数万亿、数亿等等之前对一些查询进行基准测试 用数千行样本数据填充表格是唯一的
我正在尝试测量使用 rdtsc 执行函数“check()”所需的时间,如下所示: a = rdtsc(); check(pw); b = rdtsc(); return (b-a); 但是,我收到的时
我想在我的 Hadoop 集群上执行基准测试和性能测试。我知道 hadoop-mapreduce*test*.jar 和 hadoop-mapreduce-examples*.jar 有很多用于基准测
按照目前的情况,这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持,但这个问题可能会引发辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开,visit the
这个现在非常常见的算法问题是在白板考试期间由监考人员提出的。我的工作是观察、倾听和客观判断给出的答案,但我无法控制这个问题,也无法与回答者互动。 给了五分钟的时间分析问题,考生可以写项目符号,伪代码(
我把代码从 http://www.bonto.ch/blog/2011/12/08/json-libraries-for-ios-comparison-updated/并在我的本地机器上进行了测试。
我正在尝试使用 MySQL 基准测试来测试一些查询。但是,我遇到了一个错误。 SELECT benchmark (10000, (select title from user)); 作为返回,我得到了
我很好奇这个。 我想检查哪个函数更快,所以我创建了一些代码并执行了很多次。 public static void main(String[] args) { long ts;
关闭。这个问题需要更多focused .它目前不接受答案。 想改进这个问题吗? 更新问题,使其只关注一个问题 editing this post . 关闭 9 年前。 Improve this qu
我经常想比较同一函数的多个实现的运行时性能。对于个人输入,标准是一个很好的工具。 但是有什么简单的方法可以在不同的输入大小上绘制代码的性能,例如看算法复杂度? 理想情况下,我向库传递一个类型为 Ben
我有一系列旨在完成相同功能的功能。相同的输入产生相同的输出,但是执行这些输出所需的时间因功能而异。我想确定哪个是“最快”的,我想对自己的测量结果具有“统计学意义”有一定的信心。 细读Wikipedia
我想编写一个加载基准测试,它以编译时已知的步幅跨过给定的内存区域,并在该区域的末尾(2 的幂)使用尽可能少的非加载指令进行包装有可能。 例如,给定步长 4099,rdi 中的迭代计数以及 rsi 中指
我有多个组件与 RabbitMQ 相连。有些是生产者和消费者。我需要对我的系统进行基准测试/负载测试。我需要确保消费者每秒可以处理 N 条消息。我在互联网上做了一些搜索,但还没有真正找到任何东西。有没
是否有任何基准或研究来比较这两个 IDE --稳定性-- 开发人员生产力 - 特征 - 表现-- 等等 最佳答案 我是 Eclipse 用户(不是自愿的)。不确定稳定性,但性能方面 NetBeans
我是一名优秀的程序员,十分优秀!