- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
具体来说,我使用的是 gcc -O2 -g
,但它可能适用于任何编译器。
当我使用用于分析的调试信息进行优化构建时,一个问题是编译器内联并优化了整个函数,因此从一个二十行的函数调用了几次,我最终只剩下四五个行号在代码中,一个行号已经收集了75%左右的代码,所以我很难说出瓶颈到底在哪里。让我举例说明:
void foo()
{
// code...
foo = doThingOne(); // Gets inlined
bar = doThingTwo(); // Gets inlined
externalFunction(foo, bar); // Doesn't get inlined
// code...
}
现在,当我查看分析器输出时,我看到类似这样的内容 - 百分比是在每个优化后行上花费的时间:
void foo()
10%{
// code...
3% foo = doThingOne(baz); // Gets inlined
bar = doThingTwo(wibble); // Gets inlined
75% externalFunction(foo, bar); // Doesn't get inlined
12% // code...
}
这 3% 可能就像 push baz
一样,大部分代码集中在调用 externalFunction()
的行中。我当然可以使 doThingOne()
成为外部的,但这需要付出很多努力,所以如果我能说出类似这样的话就更好了:
void foo()
{
// code...
foo = doThingOne(); // Gets inlined
#pragma optimisation_barrier
bar = doThingTwo(); // Gets inlined
#pragma optimisation_barrier
externalFunction(foo, bar); // Doesn't get inlined
// code...
}
这会将优化分成三个 block ,因此我可以清楚地看到三个函数在接近实际最终运行代码的状态下的相对权重。有这种东西吗?
最佳答案
如果您的 externalFunction
被声明为外部的,在另一个翻译单元中定义,而不是 static inline
它不会被内联,除非您要求 通过使用 gcc -flto -O2
编译和链接优化链接时间 (例如,使用 make CC='gcc -flto -O2'
构建)您的整个程序或库。另见 this .
GCC 有 pragmas for optimizations :
#pragma GCC optimize ("O2")
(也许您可以在函数体之前尝试#pragma GCC optimize("O3")
)
This would break the optimzation into three chunks
但优化适用于更大的部分,至少适用于整个函数体。我认为根据要优化的“ block ”来思考并没有多大意义。
最后,优化可能会混淆分析信息(以及 DWARF 中的调试信息)。因此,请谨慎对待,并对整个程序(或至少是程序的完整顶级功能)进行基准测试。我会谨慎对待 75% 的数字。
顺便说一句,inlining并不总是意味着加速(因为 CPU caches ,更大的代码对缓存不友好)。也许你可以增加你的 -finline-limit=
setting .但是你可能会失去性能!
此外,使用 -S -O2 -fverbose-asm
编译您的代码,并在 .s
文件中查看生成的汇编代码,然后您将看到有什么已内联。
关于c++ - 强制编译器以 block 的形式优化函数,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/42501146/
我的 blockly.js 文件中有以下代码 Blockly.Blocks['account_number'] = { // Other type. init: function() {
首先抱歉我的英语不好,我正在开发 Image Splitter 应用程序并且已经完成,但是现在的要求是当图像被分割(分成几 block /chunks)那么图像 block 的每一 block (ch
#value: 消息的返回值,当发送到一个 block 时,是该 block 中最后一句话的值。所以 [ 1 + 2. 3 + 4. ] value 计算结果为 7。我发现有时很难使用。有没有办法显式
我想构建一个包含 3 div 的响应式导航栏相同的 width和 height . 我申请了 inline-block到每个 block ,我得到一个我不理解的行为。 问题是,第三 block 由 2
我希望使用 Blockly 来允许非技术人员用户指定测试脚本。 它的一部分需要一个文件选择器,但是,我看不到 Blockly 有一个。是吗? 实际上,我找不到完整的标准 block 列表。谁有网址?
仅当您位于父 block 内部时,父 block 的 props.isSelected 才为 true,但当您在该 block 的 innerBlocks 内进行编辑时则不然。 如何从父 block
仅当您位于父 block 内部时,父 block 的 props.isSelected 才为 true,但当您在该 block 的 innerBlocks 内进行编辑时则不然。 如何从父 block
我想创建一个具有不同背景颜色 block 和不同悬停颜色 block 的导航栏 block 。我可以分别创建不同的悬停颜色 block 或不同的背景颜色 block ,但不能一起创建。所以请告诉我如何
我正在使用看到的代码 here定期执行代码: #define DELAY_IN_MS 1000 __block dispatch_time_t next = dispatch_time(DISPATC
为什么 block 必须被复制而不是保留?两者在引擎盖下有什么区别?在什么情况下不需要复制 block (如果有)? 最佳答案 通常,当您分配一个类的实例时,它会进入堆并一直存在,直到它被释放。但是,
我想弄清楚我这样做是否正确: 如果我有一个 block ,我会这样做: __weak MyClass *weakSelf = self; [self performBlock:^{
我想制作一个 4 block 导航菜单,虽然我已经显示了一个 block ,然后单击打开第二个 block ,从第二个开始选择并再次单击出现第三个 block ,第四个 block 相同...这是我的
例如,这样更好吗? try { synchronized (bean) { // Write something } } catch (Int
我想让一只乌龟检查前方小块的颜色并决定移动到哪里。如果前面的补丁不是白色的,那么乌龟向左或向右旋转并移动。我的 If 决策结构中出现错误,显示“此处应为 TRUE?FALSE,而不是 block 列表
我想创建一个 block 对角矩阵,其中对角 block 重复一定次数,非对角 block 都是零矩阵。例如,假设我们从一个矩阵开始: > diag.matrix [,1] [,2] [
我是区 block 链新手。突然我有一个问题,我们是否可以通过区 block 号来访问以太坊区 block 链上之前的区 block 数据。 例如我创建了一个block1、block2。 block
我是区 block 链新手。突然我有一个问题,我们是否可以通过区 block 号来访问以太坊区 block 链上之前的区 block 数据。 例如我创建了一个block1、block2。 block
我创建了一个等距环境,全部使用 Javascript 和 HTML5 (2D Canvas),大部分情况下工作正常。我面临的问题是使用不同高度的图 block ,然后对图 block 上的对象索引进行
这是令我困惑的代码: public Integer getInteger(BlockingQueue queue) { boolean interrupted = false; try
我有一个基于 TPL 数据流的应用程序,它仅使用批处理 block 和操作 block 就可以正常工作。 我已经添加了一个 TransformBlock 以尝试在发布到批处理 block 之前从源中转
我是一名优秀的程序员,十分优秀!