- Java 双重比较
- java - 比较器与 Apache BeanComparator
- Objective-C 完成 block 导致额外的方法调用?
- database - RESTful URI 是否应该公开数据库主键?
这个问题遵循这个 one ,考虑 GCC
兼容的编译器和 x86-64
架构。
我想知道下面的选项 1
、选项 2
和 选项 3
之间是否有任何区别。结果在所有情况下都是一样的,还是会有所不同。如果是的话会有什么区别?
// Option 1
asm volatile(:::"memory");
asm volatile("CPUID":"=a"(eax),"=b"(ebx),"=c"(ecx),"=d"(edx):"0"(level):);
和
// Option 2
asm volatile("CPUID":"=a"(eax),"=b"(ebx),"=c"(ecx),"=d"(edx):"0"(level):);
asm volatile(:::"memory");
和
// Option 3
asm volatile("CPUID":"=a"(eax),"=b"(ebx),"=c"(ecx),"=d"(edx):"0"(level):"memory");
最佳答案
选项 1 和 2 将让 CPUID 本身与不相关的非 volatile
加载/存储(在一个方向或另一个方向)重新排序。这很可能不是您想要的。
您可以在 CPUID 的两侧 放置一个内存屏障,但最好让 CPUID 本身成为一个内存屏障。
正如 Jester 所指出的,选项 1 将强制从内存中重新加载 level
,如果它的地址曾经在函数外部传递过,或者如果它已经是全局或 static
。
(或者无论决定 C 变量是否可以被使用 "memory"
破坏的 asm 读取或写入修改的确切标准是什么。我认为它与优化器使用的基本相同决定是否可以通过对不透明函数的非内联函数调用将变量保存在寄存器中,因此没有将其地址传递到任何地方并且不是 asm 语句的输入的纯局部变量仍然可以住在寄存器中)。
例如 ( Godbolt compiler explorer ):
void foo(int level){
int eax, ebx, ecx, edx;
asm volatile("":::"memory");
asm volatile("CPUID"
: "=a"(eax),"=b"(ebx),"=c"(ecx),"=d"(edx)
: "0"(level)
:
);
}
# x86-64 gcc7.3 -O3 -fverbose-asm
pushq %rbx # # rbx is call-preserved, but we clobber it.
movl %edi, %eax # level, eax
CPUID
popq %rbx #
ret
请注意缺少函数 arg 的溢出/重新加载。
通常我会使用 Intel 语法,但对于内联汇编,最好始终使用 AT&T,除非你完全讨厌 AT&T 语法或不知道它。
即使它在内存中启动(i386 System V 调用约定,带有堆栈参数),编译器仍然决定没有任何其他内容(包括带有内存破坏的 asm
语句)可以引用它。但是我们如何分辨延迟加载之间的区别呢?修改barrier之前的函数arg,然后在barrier之后使用:
void modify_level(int level){
level += 1; // modify level before the barrier
int eax, ebx, ecx, edx;
asm volatile("#mem barrier here":::"memory");
asm volatile("CPUID" // then read it after
: "=a"(eax),"=b"(ebx),"=c"(ecx),"=d"(edx)
: "0"(level):);
}
gcc -m32 -O3 -fverbose-asm
的 asm 输出是:
modify_level(int):
pushl %ebx #
#mem barrier here
movl 8(%esp), %eax # level, tmp97
addl $1, %eax #, level
CPUID
popl %ebx #
ret
请注意,编译器让 level++
跨内存屏障重新排序,因为它是一个局部变量。
Godbolt 过滤手写的 asm 注释以及编译器生成的 asm 注释行。我禁用了评论过滤器并找到了内存屏障。您可能想要删除 -fverbose-asm 以减少噪音。或者为 mem 屏障使用非注释字符串:如果您只是查看编译器的 asm 输出,则不必进行汇编。 (除非您使用的是内置汇编器的 clang)。
顺便说一句,你的问题的原始版本没有编译:你遗漏了空字符串作为 asm 模板。 汇编(:::“内存”)
。输出、输入和 clobber 部分可以为空,但 asm 指令字符串不是可选的。
有趣的是,您可以在字符串中添加 asm 注释:
asm volatile("# memory barrier here":::"memory");
gcc 在写入 asm 输出时填充字符串模板中的任何 %whatever
内容,因此您甚至可以执行诸如 "CPUID # %%0 was in %0"
并查看 gcc 为您的“虚拟”参数选择了什么,这些参数在 asm 模板中未提及。 (当你给 asm 语句一个指针时,虚拟内存输入/输出操作数告诉编译器你读/写哪个内存而不是使用 “memory”
clobber 更有趣。)
关于c++ - 在两个内联汇编调用中与在一个内联汇编调用中相比内存被破坏?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/48526388/
为了让我的代码几乎完全用 Jquery 编写,我想用 Jquery 重写 AJAX 调用。 这是从网页到 Tomcat servlet 的调用。 我目前情况的类似代码: var http = new
我想使用 JNI 从 Java 调用 C 函数。在 C 函数中,我想创建一个 JVM 并调用一些 Java 对象。当我尝试创建 JVM 时,JNI_CreateJavaVM 返回 -1。 所以,我想知
环顾四周,我发现从 HTML 调用 Javascript 函数的最佳方法是将函数本身放在 HTML 中,而不是外部 Javascript 文件。所以我一直在网上四处寻找,找到了一些简短的教程,我可以根
我有这个组件: import {Component} from 'angular2/core'; import {UserServices} from '../services/UserService
我正在尝试用 C 实现一个简单的 OpenSSL 客户端/服务器模型,并且对 BIO_* 调用的使用感到好奇,与原始 SSL_* 调用相比,它允许一些不错的功能。 我对此比较陌生,所以我可能会完全错误
我正在处理有关异步调用的难题: 一个 JQuery 函数在用户点击时执行,然后调用一个 php 文件来检查用户输入是否与数据库中已有的信息重叠。如果是这样,则应提示用户确认是否要继续或取消,如果他单击
我有以下类(class)。 public Task { public static Task getInstance(String taskName) { return new
嘿,我正在构建一个小游戏,我正在通过制作一个数字 vector 来创建关卡,该数字 vector 通过枚举与 1-4 种颜色相关联。问题是循环(在 Simon::loadChallenge 中)我将颜
我有一个java spring boot api(数据接收器),客户端调用它来保存一些数据。一旦我完成了数据的持久化,我想进行另一个 api 调用(应该处理持久化的数据 - 数据聚合器),它应该自行异
首先,这涉及桌面应用程序而不是 ASP .Net 应用程序。 我已经为我的项目添加了一个 Web 引用,并构建了各种数据对象,例如 PayerInfo、Address 和 CreditCard。但问题
我如何告诉 FAKE 编译 .fs文件使用 fsc ? 解释如何传递参数的奖励积分,如 -a和 -target:dll . 编辑:我应该澄清一下,我正在尝试在没有 MSBuild/xbuild/.sl
我使用下划线模板配置了一个简单的主干模型和 View 。两个单独的 API 使用完全相同的配置。 API 1 按预期工作。 要重现该问题,请注释掉 API 1 的 URL,并取消注释 API 2 的
我不确定什么是更好的做法或更现实的做法。我希望从头开始创建目录系统,但不确定最佳方法是什么。 我想我在需要显示信息时使用对象,例如 info.php?id=100。有这样的代码用于显示 Game.cl
from datetime import timedelta class A: def __abs__(self): return -self class B1(A):
我在操作此生命游戏示例代码中的数组时遇到问题。 情况: “生命游戏”是约翰·康威发明的一种细胞自动化技术。它由一个细胞网格组成,这些细胞可以根据数学规则生存/死亡/繁殖。该网格中的活细胞和死细胞通过
如果我像这样调用 read() 来读取文件: unsigned char buf[512]; memset(buf, 0, sizeof(unsigned char) * 512); int fd;
我用 C 编写了一个简单的服务器,并希望调用它的功能与调用其他 C 守护程序的功能相同(例如使用 ./ftpd start 调用它并使用 ./ftpd stop 关闭该实例)。显然我遇到的问题是我不知
在 dos 中,当我粘贴此命令时它会起作用: "C:\Program Files (x86)\Google\Chrome\Application\chrome.exe" https://google.
在 dos 中,当我粘贴此命令时它会起作用: "C:\Program Files (x86)\Google\Chrome\Application\chrome.exe" https://google.
我希望能够从 cmd 在我的 Windows 10 计算机上调用 python3。 我已重新安装 Python3.7 以确保选择“添加到路径”选项,但仍无法调用 python3 并使 CMD 启动 P
我是一名优秀的程序员,十分优秀!