c++ - 为什么数组访问和指针算术不等同于完全优化？-6ren

c++ - 为什么数组访问和指针算术不等同于完全优化？

转载作者：行者123 更新时间：2023-12-04 01:01:56

25

4

为什么这段代码不生成相同的程序集？ (g++ -O3)我对汇编知之甚少，但似乎案例 2 访问指令较少，所以应该是首选，对吧？我问这个是因为我想用返回指针 int* p = a[i] 的访问运算符实现一个包装类(所以访问是 a[i][j]，而不是 a[i*3+j])，但不知道是否值得。感谢您的帮助。

#include <iostream>

int main() {
    
    int a[9];
    int i, j, k;

    // Case 1
    std::cin >> i >> j >> k;
    *(a + i*3 + j) = k;

    std::cin >> i >> j >> k;
    (&a[i*3])[j] = k;

    std::cin >> i >> j >> k;
    *((&a[i*3])+j) = k;

    // Case 2
    std::cin >> i >> j >> k;
    a[i*3 + j] = k;

    std::cout << a[0];

    return 0;
}

https://godbolt.org/z/13arxcPqz

编辑:为了完整起见，将 a 移至右侧的更改与情况 2 完全相同，因为 operator+ 现在关联到左侧。

// Case 2 again
std::cin >> i >> j >> k;
        *(i*3 + j + a) = k;

https://godbolt.org/z/x89453aK4

最佳答案

表达式 *(a + i*3 + j) 和 a[i*3 + j] 在 C++ 级别是不等价的。由于二进制 + 从左到右关联，前者相当于 *((a + i*3) + j) 而后者相当于 *(a + (i*3 + j))。它们会产生不同的结果，例如，如果 i*3 + j 中的和会溢出 int。

举个具体的例子，考虑一个像 x86-64 系统一样具有 32 位 int 的 64 位机器，假设我们有 i == 600'000'000 和 j == 2'000'000'000。假设 a 不是长度为 9 的数组，而是指向 64 位上的一个非常大的数组。第一个表达式将 1'800'000'000 和 2'000'000'000 添加到 a，得到 a+ 3'800'000'000。第二个首先添加 1'800'000'000+2'000'000'000，这会溢出并导致未定义的行为。在某些编译器上，行为可能是“回绕”，产生 a+(-494'967'296)，一个与另一个地址相差 16 GB 的完全不同的地址。

生成的程序集反射(reflect)了这种区别。在第二种情况下，加法 i*3 + j 是作为普通 32 位加法完成的，它会在溢出时回绕。由于 j 在内存中，一旦我们在寄存器中得到 i，我们就可以使用普通的 add r32, m32 指令来进行加法。但在第一种情况下，i*3 + j 必须作为 64 位加法来完成才能产生正确的指针算法。所以 j 在添加之前必须符号扩展到 64 位，这不能在单个内存源添加指令中完成。相反，我们首先使用 movsx r64, m32 将 j 加载到带有符号扩展的寄存器中，然后 add r64, r64 来执行 64-位加法。这解释了为什么需要额外的指令。

这两个“应该首选”中的哪一个与效率无关，而与您的代码是否可以用会溢出的参数调用以及您希望在这种情况下发生什么有关。在优化之前担心正确的行为。

只是为了突出显示我正在谈论的代码:*(a + i*3 + j) = k; 在 the asm code linked in the question 的第 12-13 和 16-20 行执行。 :

        mov     eax, DWORD PTR [rsp+4]        ; eax = i, zero-extend
        movsx   rdx, DWORD PTR [rsp+8]        ; rdx = (int64_t)j, sign-extend to 64 bits
        ;;; lea     rsi, [rsp+4]              ; unrelated, set up args for next cin
        ;;; mov     edi, OFFSET FLAT:_ZSt3cin ; unrelated, set up args for next cin
        lea     eax, [rax+rax*2]              ; eax = i*3, still 32 bits
        cdqe                                  ; rax = (int64_t)i*3, sign-extended
        add     rax, rdx                      ; rax = (int64_t)(i*3) + (int64_t)j
        mov     edx, DWORD PTR [rsp+12]       ; edx = k
        mov     DWORD PTR [rsp+16+rax*4], edx ; perform the store

然后是接下来两个版本的代码，(&a[i*3])[j] = k; (28-29 and 30-36) and *((&a [i*3])+j) = k;(44-45和48-52)是一样的；这些也对应于两个“指针加索引”步骤，并且从不执行 int 加法。

而 a[i*3 + j] = k; 位于第 60-65 行:

        mov     eax, DWORD PTR [rsp+4]        ; eax = i
        mov     edx, DWORD PTR [rsp+12]       ; edx = k
        lea     eax, [rax+rax*2]              ; eax *= 3
        add     eax, DWORD PTR [rsp+8]        ; eax += j (32 bit add!)
        cdqe                                  ; rax = (int64_t)(i*3+j)
        mov     DWORD PTR [rsp+16+rax*4], edx ; do the store

关于c++ - 为什么数组访问和指针算术不等同于完全优化？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/68053581/

25

4

0

文章推荐： AngularJS 指令在元素完全加载之前运行

文章推荐： typescript - 类型 'User | undefined' 不可分配给类型 'User'

javascript - php 访问 mqsql 或 html 访问 json 或 html 访问 xml ？哪个更快？
关闭。这个问题是opinion-based 。目前不接受答案。想要改进这个问题吗？更新问题，以便 editing this post 可以用事实和引文来回答它。 . 已关闭 4 年前。 Improv
powershell - API 访问 PowerShell Web 访问？
PowerShell Web Access 允许您通过 Web 浏览器运行 PowerShell cmdlet。它显示了一个基于 Web 的控制台窗口。有没有办法运行 cmdlet 而无需在控制台窗
c# - 如何使用应用程序级身份验证/访问 token 访问 Sharepoint 文件？
我尝试在无需用户登录的情况下访问 Sharepoint 文件。我可以通过以下任一方式获取访问 token 方法一: var client = new RestClient("https://logi
soap - 使用 OAuth 访问 token 访问 SOAP 服务？
我目前正在尝试通过 Chrome 扩展程序访问 Google 服务。我的理解是，对于 JS 应用程序，Google 首选的身份验证机制是 OAuth。我的应用目前已成功通过 OAuth 向服务进行身份
C++ - 允许通过基类(接口(interface))访问，禁止通过派生类(具体实现)访问？
假设我有纯抽象类 IHandler 和派生自它的类: class IHandler { public: virtual int process_input(char input) = 0; };
css - 可以通过 URL 访问 CSS 文件，但不能从 HTML 访问
我有一个带有 ThymeLeaf 和 Dojo 的 Spring 应用程序，这给我带来了问题。当我从我的 HTML 文件中引用 CSS 文件时，它们在 Firebug 中显示为中止。但是，当我通过在地
javascript - 为什么我可以用 [val] 访问 js 对象，但不能用 .val 访问？
这个问题已经有答案了: JavaScript property access: dot notation vs. brackets? (17 个回答) 已关闭 6 年前。为什么这不起作用？ func
.htaccess - 仅允许通过 http 访问 robot.txt，其他通过 https 访问
我想将所有流量重定向到 https，只有 robot.txt 应该可以通过 http 访问。是否可以为 robot.txt 文件创建异常(exception)？我的 .htaccess 文件: R
oauth-2.0 - 无法使用有效的 oauth2 访问 token 访问 Linkedin 个人资料
我遇到了 LinkedIn OAuth2: "Unable to verify access token" 中描述的相同问题;但是，那里描述的解决方案并不能解决我的问题。我能够成功请求访问 toke
Docker 容器不能通过 localhost 访问，但可以通过 127.0.0.1 访问
问题我有一个暴露给 *:8080 的 Docker 服务容器. 我无法通过 localhost:8080 访问容器. Chrome /curl无限期挂断。但是如果我使用任何其他本地IP，我就可以访
python - 使用 OAuth 2.0 访问 token 访问 Gmail Imap
我正在使用 Google 的 Oauth 2.0 来获取用户的 access_token，但我不知道如何将它与 imaplib 一起使用来访问收件箱。最佳答案下面是带有 oauth 2.0 的 I
curl - 可以从 curl 访问 docker 服务，但不能从 postman/chrome 访问
我正在做 docker 入门指南:https://docs.docker.com/get-started/part3/#recap-and-cheat-sheet-optional docker-co
azure - 带有 Nginx 的 AKS 无法通过 IP 访问，只能通过 DNS 访问
我正在尝试使用静态 IP 在 AKS 上创建一个 Web 应用程序，自然找到了一个带有 Nginx ingress controller in Azure's documentation 的解决方案。
javascript - 为什么可以将 'module.exports' 作为 'exports' 访问，但不能使用 'module.id' 访问？
这是我在名为 foo.js 的文件中的代码。 console.log('module.exports:', module.exports) console.log('module.id:', modu
amazon-web-services - aws 访问 key ID 和 secret 访问 key
我试图理解访问键。我读过https://docs.aws.amazon.com/general/latest/gr/aws-sec-cred-types.html#access-keys-and-se
xcode - 从 iOS 5 访问 Twitter 时 OAuth 访问 token 失败
我正在使用 MGTwitterEngine"将 twitter 集成到我的应用程序中。它在 iOS 4.2 上运行良好。当我尝试从任何 iOS 5 设备访问 twitter 时，我遇到了身份验证 to
amazon-web-services - aws 访问 key ID 和 secret 访问 key
我试图理解访问键。我读过https://docs.aws.amazon.com/general/latest/gr/aws-sec-cred-types.html#access-keys-and-se
ios - 如果 Facebook 访问 token 过期，会生成新的 Facebook 访问 token 吗？
我正在使用以下 API 列出我的 Facebook 好友。 https://graph.facebook.com/me/friends?access_token= ??? 我想知道访问 token 过
google-app-engine - 尝试使用 API key 访问 BigQuery 时出错(简单 API 访问)
401 Unauthorized - Show headers - { "error": { "errors": [ { "domain": "global", "reas
django - 从 heroku 访问 s3 内容时，AWS 访问 key 显示在浏览器 url 中
我已经将我的 django 应用程序部署到 heroku 并使用 Amazon s3 存储桶存储静态文件，我发现从 s3 存储桶到 heroku 获取数据没有问题。但是，当我测试查看内容存储位置时，除

首页

博学

6Ren·AI

商城

c++ - 为什么数组访问和指针算术不等同于完全优化？