- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个 C 程序,例如:
#include <stdio.h>
struct sa {
char buffer[24];
};
void proceed(const struct sa *data);
static inline void func(struct sa sa) {
proceed(&sa);
}
void test(struct sa sa) {
func(sa);
}
看来在test
函数的最优汇编输出中,它的sa
参数的地址可以直接传给proceed
函数,因为 proceed
函数保证不会更改 data
。但是,编译器(x86-64 clang 14.0 和 gcc 12.1,-O3 优化级别)发出的程序集如下:
test: # @test
sub rsp, 24
mov rax, qword ptr [rsp + 48]
mov qword ptr [rsp + 16], rax
movaps xmm0, xmmword ptr [rsp + 32]
movaps xmmword ptr [rsp], xmm0
mov rdi, rsp
call proceed
add rsp, 24
ret
请注意,在输出中,整个 sa
结构从 [rsp + 32] 复制到 [rsp]。为什么编译器不消除这样的拷贝?
最佳答案
这显然是一个遗漏的优化错误,因为它只发生在额外级别的内联 func()
中。
您可以在 https://github.com/llvm/llvm-project/issues 上报告错误和 https://gcc.gnu.org/bugzilla/enter_bug.cgi?product=gcc (GCC 错误报告更喜欢 AT&T 语法,所以在您的 Godbolt 链接中选择它;在 GCC 错误报告中包含一个 Godbolt 链接以及实际代码和 asm 通常是好的,这样 future 的读者可以很快检查它是否已被修复,或玩弄它。)
对于 GCC,使用关键字 missed-optimization
。
since the proceed function is guaranteed not to change
data
不,丢弃 const
是合法的,因为原始指向的对象不是 const
。但它仍然不需要复制;您的函数拥有其堆栈参数空间,并且可以让其他函数根据需要修改唯一的副本。 (大多数调用约定都是这样工作的,包括所有 System V 约定,例如此处使用的 x86-64 SysV。另外我认为 Windows x64,其中大于 8 字节的参数通过非常量(?)传递给保留空间由调用者使用寄存器中的指针,或者如果前面有 4 个或更多参数则在堆栈中。)
test
的调用者不能假定它是未修改的,因此使用相同 arg 的另一个调用将需要在返回后重新复制结构。甚至 foo(const struct sa);
也会这样工作;无法声明/ promise 函数不会将其堆栈参数空间重用于临时空间或尾调用的参数。
This test-case on Godbolt 表明这是一个遗漏的优化:如果 noinline
,test
将仅使用 jmp func
进行尾调用,而不是在那里复制任何参数。 func
的非内联定义也不会复制,只是预期的 RSP 对齐然后 lea rdi, [rsp+16]
/call proceed
将指针传递给它的堆栈参数。
因此将 __attribute__((noinline))
添加到您的 func
将导致您的 test
调用 proceed
而不复制 arg,在执行路径中只有一个额外的 jmp
。如果那是合法的,那么在内联 func
时这样做也是合法的。
struct sa {
char buffer[24];
};
void proceed(const struct sa *data);
__attribute__((noinline))
static void func(struct sa sa) {
proceed(&sa);
}
void test_struct(struct sa sa) {
func(sa);
}
// same as non-inline func()
// void test_struct_direct(struct sa sa) { proceed(&sa); }
# clang (trunk) -O3
# GCC is equivalent but uses sub/add instead of dummy push/pop
test_struct:
jmp func # TAILCALL
func:
pushq %rax # re-align the stack by 16
leaq 16(%rsp), %rdi
callq proceed
popq %rax # clean up the stack
retq
请随意在您的错误报告中短链接确切的 Godbolt 链接,或者添加评论或未评论的内容;它使用每晚构建的 GCC 和 clang,因此开发人员会知道它尚未修复。也可以随意链接此 Stack Overflow Q&A,但您的错误报告应该是独立的,并指出优化是合法的,并且取消注释 __attribute__((noinline))
会有所不同。
(因此,对于错误报告,您可能希望将 noinline
注释掉,并取消注释手动内联 func
的 test_struct_direct
版本。 )
关于c - 为什么 clang 和 gcc 会产生次优输出(复制结构)以将指针传递给按值结构 arg?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/72859532/
Github:https://github.com/jjvang/PassIntentDemo 我一直在关注有关按 Intent 传递对象的教程:https://www.javacodegeeks.c
我有一个 View ,其中包含自动生成的 text 类型的 input 框。当我单击“通过电子邮件发送结果”按钮时,代码会将您带到 CalculatedResults Controller 中的 Em
我有一个基本的docker镜像,我将以此为基础构建自己的镜像。我没有基础镜像的Dockerfile。 基本上,基本镜像使用两个--env arg,一个接受其许可证,一个选择在容器中激活哪个框架。我可以
假设我想计算 2^n 的总和,n 范围从 0 到 100。我可以编写以下内容: seq { 0 .. 100 } |> Seq.sumBy ((**) 2I) 但是,这与 (*) 或其他运算符/函数不
我有这个网址: http://www.example.com/get_url.php?ID=100&Link=http://www.test.com/page.php?l=1&m=7 当我打印 $_G
我想将 window.URL.createObjectURL(file) 创建的地址传递给 dancer.js 但我得到 GET blob:http%3A//localhost/b847c5cd-aa
我想知道如何将 typedef 传递给函数。例如: typedef int box[3][3]; box empty, *board[3][3]; 我如何将 board 传递给函数?我
我正在将一些代码从我的 Controller 移动到核心数据应用程序中的模型。 我编写了一个方法,该方法为我定期发出的特定获取请求返回 NSManagedObjectID。 + (NSManagedO
为什么我不能将类型化数组传递到采用 any[] 的函数/构造函数中? typedArray = new MyType[ ... ]; items = new ko.observableArray(ty
我是一名新的 Web 开发人员,正在学习 html5 和 javascript。 我有一个带有“选项卡”的网页,可以使网页的某些部分消失并重新出现。 链接如下: HOME 和 JavaScript 函
我试图将对函数的引用作为参数传递 很难解释 我会写一些伪代码示例 (calling function) function(hello()); function(pass) { if this =
我在尝试调用我正在创建的 C# 项目中的函数时遇到以下错误: System.Runtime.InteropServices.COMException: Operation is not allowed
使用 ksh。尝试重用当前脚本而不修改它,基本上可以归结为如下内容: `expr 5 $1 $2` 如何将乘法命令 (*) 作为参数 $1 传递? 我首先尝试使用“*”,甚至是\*,但没有用。我尝试
我一直在研究“Play for Java”这本书,这本书非常棒。我对 Java 还是很陌生,但我一直在关注这些示例,我有点卡在第 3 章上了。可以在此处找到代码:Play for Java on Gi
我知道 Javascript 中的对象是通过引用复制/传递的。但是函数呢? 当我跳到一些令人困惑的地方时,我正在尝试这段代码。这是代码片段: x = function() { console.log(
我希望能够像这样传递参数: fn(a>=b) or fn(a!=b) 我在 DjangoORM 和 SQLAlchemy 中看到了这种行为,但我不知道如何实现它。 最佳答案 ORM 使用 specia
在我的 Angular 项目中,我最近将 rxjs 升级到版本 6。现在,来自 npm 的模块(在 node_modules 文件夹内)由于一些破坏性更改而失败(旧的进口不再有效)。我为我的代码调整了
这个问题在这里已经有了答案: The issue of * in Command line argument (6 个答案) 关闭 3 年前。 我正在编写一个关于反向波兰表示法的 C 程序,它通过命
$(document).ready(function() { function GetDeals() { alert($(this).attr("id")); } $('.filter
下面是一个例子: 复制代码 代码如下: use strict; #这里是两个数组 my @i =('1','2','3'); my @j =('a','b','c'); &n
我是一名优秀的程序员,十分优秀!