- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
正如这个问题的标题中提到的,当我出于临时原因修改 asm 语句中的一些寄存器时,在 clobber 和 dummy 输出之间哪个选项更好?
例如,我在 link 中实现了两个版本的交换功能, 并发现两个版本生成相同数量的输出指令。
我应该使用哪个版本?我是否应该使用具有虚拟输出的寄存器来让编译器尽可能地选择可以优化整个功能的寄存器?
如果答案是肯定的,那么我什么时候应该使用 clobber 列表?只有当一条指令要求您将其操作数加载到特定寄存器时,才可以使用 clobber 列表吗?比如syscall指令要求它的参数应该位于寄存器rdi rsi rdx r10 r8 r9??
最佳答案
您通常应该让编译器为您选择寄存器,使用具有任何所需约束的早期破坏虚拟输出1。这使其可以灵活地为函数进行寄存器分配。
1 例如您可以使用 +&Q
获取 RAX/RBX/RCX/RDX 之一:具有 AH/BH/CH/DH 的寄存器。如果您想使用 movzbl %h[input], %[high_byte]
解压 8 位字段; movzbl %b[输入], %[low_byte]
; shr $16, %[input]
,您需要一个寄存器,它的第二个 8 位 block 别名为高 8 位寄存器。
Out of curiosity, when we consider a calling convention of amd64, some registers can be freely used inside the functions; and we could implement some functions by only using those registers inside the asm statement. Why allowing the compiler to choose the registers to be used is better than the mentioned one?
因为函数可以内联,可能内联到调用其他函数的循环中,因此编译器会希望在调用保留寄存器中为其提供输入。如果您正在编写一个独立的函数,那么编译器总是需要调用,你从内联 asm 而不是独立的 asm 得到的只是编译器处理调用约定差异和 C++ 名称修改。
或者周围的代码可能使用了一些需要固定寄存器的指令,例如用于移位计数的 cl
或用于 div
的 RDX:RAX。
when should I use the clobber list? ...such as syscall instruction requires its parameter should be located in register rdi rsi rdx r10 r8 r9??
通常您会改用输入约束,因此只有 syscall
指令本身在内联 asm 中。但是 syscall
(指令本身)会破坏 RCX 和 R11,因此使用它进行的系统调用不可避免地会破坏用户空间的 RCX 和 R11。对这些使用虚拟输出没有意义,除非您使用返回地址 (RCX) 或 RFLAGS (R11)。所以是的,clobbers 在这里很有用。
// the compiler will emit all the necessary MOV instructions
#include <stddef.h>
#include <asm/unistd.h>
// the compiler will emit all the necessary MOV instructions
//static inline
size_t sys_write(int fd, const char *buf, size_t len) {
size_t retval;
asm volatile("syscall"
: "=a"(retval) // EDI RSI RDX
: "a"(__NR_write), "D"(fd), "S"(buf), "d"(len)
, "m"(*(char (*)[len]) buf) // dummy memory input: the asm statement reads this memory
: "rcx", "r11" // clobbered by syscall
// , "memory" // would be needed if we didn't use a dummy memory input
);
return retval;
}
它的非内联版本编译如下(使用 gcc -O3
on the Godbolt compiler explorer ),因为函数调用约定几乎与系统调用约定匹配:
sys_write(int, char const*, unsigned long):
movl $1, %eax
syscall
ret
在任何输入寄存器上使用 clobber 并将 mov
放入 asm 中真的很愚蠢:
size_t dumb_sys_write(int fd, const char *buf, size_t len) {
size_t retval;
asm volatile(
"mov %[fd], %%edi\n\t"
"mov %[buf], %%rsi\n\t"
"mov %[len], %%rdx\n\t"
"syscall"
: "=a"(retval) // EDI RSI RDX
: "a"(__NR_write), [fd]"r"(fd), [buf]"r"(buf), [len]"r"(len)
, "m"(*(char (*)[len]) buf) // dummy memory input: the asm statement reads this memory
: "rdi", "rsi", "rdx", "rcx", "r11"
// , "memory" // would be needed if we didn't use a dummy memory input
);
// if(retval > -4096ULL) errno = -retval;
return retval;
}
dumb_sys_write(int, char const*, unsigned long):
movl %edi, %r9d
movq %rsi, %r8
movq %rdx, %r10
movl $1, %eax # compiler generated before this
# from inline asm
mov %r9d, %edi
mov %r8, %rsi
mov %r10, %rdx
syscall
# end of inline asm
ret
除此之外,您不会让编译器利用 syscall
不会破坏其任何输入寄存器这一事实。编译器可能仍然需要寄存器中的 len
,并且使用纯输入约束让它知道该值之后仍会存在。
如果您使用任何隐式使用某些寄存器的指令,您也可以使用 clobbers,但这些指令的输入和输出都不是 asm 语句的直接输入或输出。不过,这种情况很少见,除非您在内联 asm 中编写整个循环或大块代码。
或者,如果您正在包装一条 call
指令。 (很难安全地做到这一点,特别是因为红区,但人们确实尝试这样做)。您无法选择代码破坏的寄存器,因此您只需将其告知编译器即可。
关于assembly - 对于 asm 语句中的临时寄存器,我应该使用 clobber 还是虚拟输出?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/54061267/
我正在使用 OUTFILE 命令,但由于权限问题和安全风险,我想将 shell 的输出转储到文件中,但出现了一些错误。我试过的 #This is a simple shell to connect t
我刚刚开始学习 Java,我想克服在尝试为这个“问题”创建 Java 程序时出现的障碍。这是我必须创建一个程序来解决的问题: Tandy 喜欢分发糖果,但只有 n 颗糖果。对于她给第 i 个糖果的人,
你好,我想知道我是否可以得到一些帮助来解决我在 C++ 中打印出 vector 内容的问题 我试图以特定顺序在一个或两个函数调用中输出一个类的所有变量。但是我在遍历 vector 时收到一个奇怪的错误
我正在将 intellij (2019.1.1) 用于 java gradle (5.4.1) 项目,并使用 lombok (1.18.6) 来自动生成代码。 Intellij 将生成的源放在 out
编辑:在与 guest271314 交流后,我意识到问题的措辞(在我的问题正文中)可能具有误导性。我保留了旧版本并更好地改写了新版本 背景: 从远程服务器获取 JSON 时,响应 header 包含一
我的问题可能有点令人困惑。我遇到的问题是我正在使用来自 Java 的 StoredProcedureCall 调用过程,例如: StoredProcedureCall call = new Store
在我使用的一些IDL中,我注意到在方法中标记返回值有2个约定-[in, out]和[out, retval]。 当存在多个返回值时,似乎使用了[in, out],例如: HRESULT MyMetho
当我查看 gar -h 的帮助输出时,它告诉我: [...] gar: supported targets: elf64-x86-64 elf32-i386 a.out-i386-linux [...
我想循环遍历一个列表,并以 HTML 格式打印其中的一部分,以代码格式打印其中的一部分。所以更准确地说:我想产生与这相同的输出 1 is a great number 2 is a great
我有下面的tekton管道,并尝试在Google Cloud上运行。集群角色绑定。集群角色。该服务帐户具有以下权限。。例外。不确定需要为服务帐户设置什么权限。
当尝试从 make 过滤非常长的输出以获取特定警告或错误消息时,第一个想法是这样的: $ make | grep -i 'warning: someone set up us the bomb' 然而
我正在创建一个抽象工具类,该类对另一组外部类(不受我控制)进行操作。外部类在某些接口(interface)点概念上相似,但访问它们相似属性的语法不同。它们还具有不同的语法来应用工具操作的结果。我创建了
这个问题已经有答案了: What do numbers starting with 0 mean in python? (9 个回答) 已关闭 7 年前。 在我的代码中使用按位与运算符 (&) 时,我
我写了这段代码来解析输入文件中的行输入格式:电影 ID 可以有多个条目,所以我们应该计算平均值输出:**没有重复(这是问题所在) import re f = open("ratings2.txt",
我需要处理超过 1000 万个光谱数据集。数据结构如下:大约有 1000 个 .fits(.fits 是某种数据存储格式)文件,每个文件包含大约 600-1000 个光谱,其中每个光谱中有大约 450
我编写了一个简单的 C 程序,它读取一个文件并生成一个包含每个单词及其出现频率的表格。 该程序有效,我已经能够在 Linux 上运行的终端中获得显示的输出,但是,我不确定如何获得生成的显示以生成包含词
很难说出这里要问什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或夸夸其谈,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开,visit the help center . 关闭 1
1.普通的输出: print(str)#str是任意一个字符串,数字··· 2.格式化输出: ?
我无法让 logstash 正常工作。 Basic logstash Example作品。但后来我与 Advanced Pipeline Example 作斗争.也许这也可能是 Elasticsear
这是我想要做的: 我想让用户给我的程序一些声音数据(通过麦克风输入),然后保持 250 毫秒,然后通过扬声器输出。 我已经使用 Java Sound API 做到了这一点。问题是它有点慢。从发出声音到
我是一名优秀的程序员,十分优秀!