- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
是否有脚本可用于对一些 objdump --disassemble
输出进行后期处理以使用循环计数进行注释?特别是对于 ARM 系列。
大多数情况下,这只是模式匹配与计数表查找。我猜可能需要像
Perl、python、bash、+5M
这样的注释来表示五个内存周期。
C
等都可以。我认为这可以通用地完成,但我对 ARM 很感兴趣,它有一个正交 指令集。这是 68HC11 上的一个主题做同样的事情。该脚本需要一个 CPU model 选项来选择合适的周期数;我认为这些计数已经存在于 gcc
机器描述中。
我认为没有用于此的 objdump
开关,但 RTFM 会很棒。
编辑:澄清一下,当代码从缓存中执行时,最佳情况内存子系统等假设是可以的。目标不是像某些正在运行的机器那样 100% 准确的循环计数。有可能得到一个合理的估计,否则编译器设计是不可能的。
作为DWelch指出,像最近的 Cortex 芯片一样,深度流水线架构无法实现简单的总计。 objdump
后处理必须查看周围的操作码。 gcc 插件更有可能实现这一点,因为它是新的 (4.5+),我认为这样的东西不存在。 ARM926 的脚本当然是可能的,而且相当简单。
内存延迟无关紧要。内存 Controller 就像另一个 CPU
。当 CPU 正在做算术等时,它正在做它的事情。一个好的/调整好的算法将 parallel内存访问与计算。通过计算加载/存储和周期,您可以确定在使用计时器主动分析时完成了多少并行性。由于寄存器之间的互锁,流水线很重要,但是 basic blocks 的循环计数即使在现代 ARM 处理器上也可以可靠地计算和使用;这对于一个简单的脚本来说太复杂了。
最佳答案
在现代高端 ARM 上,仅通过查看指令无法评估周期计数。有很多运行时状态会影响指令在现实世界中的退出率。缓存中是否存在它需要的数据?该指令是否依赖于先前的指令结果?如果是这样,转发单元消除了哪些延迟?加载/存储缓冲区有多满?它涉及什么样的内存映射?该指令需要的处理器流水线有多满?流中是否有同步指令?猜测是否提出了它所依赖的一些数据?寄存器重命名器的状态是什么?条件指令是否已填满流水线,或者解码器是否足够聪明以完全跳过它们?核心时钟与总线和内存时钟之间的比率是多少?分支预测表的大小是多少?
如果没有完整的处理器模拟,您所能得到的只是猜测。这些数字对您是否有意义取决于您试图用它们完成什么。
关于gcc - 使用 ARM 周期计数后处理 `objdump --disassemble`,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/14942436/
我正在尝试在 Conda 环境中编译一些代码,在那里我 之前安装的编译包gcc_linux-64 . 然而,即使在停用和重新激活环境之后,gcc还在/usr/bin/gcc . 我该怎么做才能让 Co
关闭。这个问题是opinion-based .它目前不接受答案。 想要改进这个问题? 更新问题,以便 editing this post 可以用事实和引用来回答它. 关闭 7 年前。 Improve
这其实是两个问题: 1 - 在我的 debian amd64 系统上,我似乎无法构建与 gmp/mpfr/mpc 动态链接的交叉 GCC。即使我删除 --disable-shared,它也总是静态链接
研究ELF格式的结果,可以看到目标文件中有一个符号对应每个函数,对应的符号表项的值为st_size,表示大小的功能。 问题是,即使我更改了目标文件中特定函数的 st_size 并链接了它,但可执行文件
海湾合作委员会的 documentation for #line directives说他们是这样的: #line "myfile.cpp" 123 但是当我用 g++ 5.1 检查输出时,它们实际上
我正在使用 as 和 gcc 来汇编和创建 ARM 汇编程序的可执行文件,正如 this 所推荐的那样教程,如下: 给定一个汇编源文件,program.s,我运行: as -o program.o p
long long x; double n; x=long long(n); 这不起作用。什么是正确的方法? 最佳答案 显而易见的: x = (long long) n; 关于gcc - 转换为长长
我想知道用于 gcc 的原子内置函数的头文件是什么? 我想使用这 2 个函数为我当前创建的线程库实现互斥锁。 bool __sync_bool_compare_and_swap (type *ptr,
它出现在 another question :gcc调用的程序和部件是什么? (特别是在编译 C 或 C++ 时)以便有人可以设计一些拦截和更改流程的方案以用于各种自定义编码目的? 最佳答案 编译器二
可能吗?我想使用 gcc喜欢 assembler并在将其编译为 ubuntu 上的可执行文件后。 我尝试过这个: gcc a.asm -o out.o 来自 out.o文件编译成.out可执行文件。
我写了一个简单的 C 程序 test.c : #include #include int add(int a, int b); int main() { int i=5,j=10;
即。所以如果你使用任何八进制文字,它会给你一个警告。 微软编译器的同样问题。 如果没有,是否有任何其他工具可以检测八进制文字。 (vim 似乎有一个很酷的技巧,它突出了第一个领先的将不同的颜色归零,但
我在旧线程中搜索。但没有找到任何线程回答我的问题。 gcc 是否像 vc++ 一样支持函数级链接? 如果是,我应该提供什么选项来链接目标文件和库? 最佳答案 看起来 gcc 不直接支持函数级链接。您可
也许标题并没有把问题说得那么准确:我知道当我运行 gcc foo.c 时,GCC 会调用其他为它完成所有工作的子程序,从而生成主 gcc 程序只是一个界面。但这究竟是如何完成的呢? 它是否使用syst
我听说最近版本的 gcc 非常擅长将通过函数指针的调用转换为直接调用。但是,我在网上或快速浏览 gcc 的源代码上找不到任何关于它的信息。有谁知道这是否真的是真的,如果是这样,它使用什么算法来做到这一
gcc/g++ 链接器选项“-Map”生成的“.map”文件用于什么? 以及如何阅读它们? 最佳答案 我建议为您投入生产的任何软件生成一个映射文件并保留一份副本。 它可用于破译崩溃报告。根据系统的不同
gcc信息文件在有关x86-64特定标志的部分中说 其他事情: There is no `-march=generic' option because `-march' ind
我想知道 gcc 链接器选项(例如:-Wl,options)是否可以更改编译后的可执行文件中的汇编指令,因为如果您使用某些 gcc 优化选项会发生这种情况? 当您比较编译后的二进制文件(例如比较签名)
是否有GCC编译指示会停止,暂停或中止编译过程? 我正在使用gcc 4.1,但也希望在gcc 3.x版本上也可以使用该编译指示。 最佳答案 您可能需要#error: edd@ron:/tmp$ g++
当我使用gcc编译C程序时我通常使用 -g 将一些调试信息放入 elf 文件中这样 gdb 就可以在需要时帮助我。 但是,我注意到有些程序使用 -ggdb,因为它应该使调试信息对 gdb 更加友好。
我是一名优秀的程序员,十分优秀!