c - 矢量化 strlen 摆脱读取未分配的内存-6ren

c - 矢量化 strlen 摆脱读取未分配的内存

转载作者：太空狗更新时间：2023-10-29 17:16:06

24

4

在研究 OSX 10.9.4 对 strlen 的实现时，我注意到它总是比较 16 字节的 block 并向前跳到下面的 16 字节，直到它遇到 '\0'。相关部分:

3de0:   48 83 c7 10             add    $0x10,%rdi
3de4:   66 0f ef c0             pxor   %xmm0,%xmm0
3de8:   66 0f 74 07             pcmpeqb (%rdi),%xmm0
3dec:   66 0f d7 f0             pmovmskb %xmm0,%esi
3df0:   85 f6                   test   %esi,%esi
3df2:   74 ec                   je     3de0 <__platform_strlen+0x40>

0x10 是十六进制的 16 个字节。

当我看到它时，我在想:这 block 内存也可以不分配。如果我分配了一个 20 字节的 C 字符串并将其传递给 strlen，它将读取 36 字节的内存。为什么允许这样做？我开始寻找并找到了 How dangerous is it to access an array out of bounds?

这证实了这绝对不是一件好事，例如，未分配的内存可能未映射。然而，必须有一些东西使它起作用。我的一些假设:

OSX 不仅保证其分配是 16 字节对齐的，而且还保证分配的“量子”是 16 字节的 block 。换句话说，分配 5 个字节实际上将分配 16 个字节。分配 20 个字节实际上将分配 32 个字节。
在编写 asm 时读取数组末尾本身并无害处，因为这不是未定义的行为，只要它在边界内(在页面内？)。

真正的原因是什么？

编辑:刚刚找到Why I'm getting read and write permission on unallocated memory? ，这似乎表明我的第一个猜测是正确的。

编辑 2:愚蠢的是，我忘记了尽管 Apple 似乎已经删除了大部分 asm 实现的源代码(Where did OSX's x86-64 assembly libc routines go?)，但它留下了 strlen:http://www.opensource.apple.com/source/Libc/Libc-997.90.3/x86_64/string/strlen.s

在评论中我们发现:

//  returns the length of the string s (i.e. the distance in bytes from
//  s to the first NUL byte following s).  We look for NUL bytes using
//  pcmpeqb on 16-byte aligned blocks.  Although this may read past the
//  end of the string, because all access is aligned, it will never
//  read past the end of the string across a page boundary, or even
//  accross a cacheline.

编辑:老实说，我认为所有回答者都应该得到一个可接受的答案，并且基本上都包含理解问题所需的信息。所以我去寻找声誉最低的人的答案。

最佳答案

我是相关例程的作者。

正如其他一些人所说，关键是读取全部对齐。虽然读取数组边界之外的内容在 C 中是未定义的行为，但我们不是在编写 C；除了 C 抽象机定义的内容之外，我们还了解很多 x86 架构的细节。

特别是，超出缓冲区末尾的读取是安全的(这意味着它们不会产生陷阱或其他可观察到的副作用)只要它们不跨越页面边界(因为内存属性和映射是在页面粒度上跟踪的) .由于支持的最小页面大小为 4096 字节，因此对齐的 16 字节加载不能跨越页面边界。

关于c - 矢量化 strlen 摆脱读取未分配的内存，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/25566302/

24

4

0

文章推荐： c - 打印字符数组元素

文章推荐： python - 无法在带有 GPU 的 tensorflow 教程中运行词嵌入示例

文章推荐： c - sscanf 1 字节十六进制数据，无溢出

文章推荐： c - 在 C 中，是否可以？增加一个未初始化的整数？

iphone - GKSession 分配/释放/分配 = 泄漏和崩溃
我有一个应用程序，它会抛出 GKSession 并在各种条件下(连接超时、 session 失败等)创建一个新的 GKSession。不过，我遇到了内存泄漏问题，并且有时会在重新连接几次循环后崩溃。
c - 是否可以说哪个指针由 cudaMalloc 分配，哪个由 malloc 分配？
比如我在宿主代码中有一个浮点指针 float *p 是否可以确定他指向的内存类型(设备/主机)？最佳答案在 UVA system 中, 运行时 API 函数 cudaPointerGetAttri
.net - 运行时类型句柄.分配
我已将项目转换为 .Net 4.0 并且以下代码不起作用: typeof(RuntimeTypeHandle).GetMethod("Allocate", BindingFlags.Instance
分配 `ab` 时包含单个字符的字符
当我声明 char ch = 'ab' 时，ch 只包含 'b'，为什么它不存储 'a'？ #include int main() { char ch = 'ab'; printf("%c"
文件的磁盘扇区和 block 分配
我对 Disk Sector 和 Block 有疑问。扇区是一个单位，通常为 512 字节或 1k、2k、4k 等取决于硬件。文件系统 block 大小是一组扇区大小。假设我正在存储一个 5KB 的
javascript - 分配/分发随机数量
假设我有 8 个人和5000 个苹果。我想将所有苹果分发给所有 8 个人，这样我就没有苹果了。但每个人都应该得到不同数量将它们全部分发出去的最佳方式是什么？我是这样开始的: let peopl
javascript - 分配 "/"热键以在搜索框上创建焦点用户
我正在构建的网站顶部有一个搜索栏。与 Trello 或 Gmail 类似，我希望当用户按下“/”键时，他们的焦点就会转到该搜索框。我的 JavaScript 看起来像这样: document.onk
javascript - 事件处理程序之间的一个 $this 分配
我有一小段代码: if (PZ_APP.dom.isAnyDomElement($textInputs)){ $textInputs.on("focus", function(){
iphone - iOS保留，分配
我观察到以下行为。接受了两个属性变量。 @property (nonatomic, retain) NSString *stringOne; @property (nonatomic, assign
java - BODMAS 分配
我正在解决这样的问题 - 实现一个计算由以下内容组成的表达式的函数以下操作数:“(”、“)”、“+”、“-”、“*”、“/”。中的每个数字表达式可能很大(与由字符串表示的一样大)1000 位)。 “/
python - 主机中任务的指派/分配
我有一组主机和一组任务。每个主机都有 cpu、mem 和任务容量，每个任务都有 cpu、mem 要求。每个主机都属于一个延迟类别，并且可以与具有特定延迟值的其他主机通信。每个任务可能需要以等于或
c - c中内存的重新分配/分配
该程序的作用:从文件中读取一个包含 nrRows 行和 nrColomns 列的矩阵(二维数组)。矩阵的所有元素都是 [0,100) 之间的整数。程序必须重新排列矩阵内的所有元素，使每个元素等于其所在
c++ - 长号。分配
世界!我有个问题。今天我尝试创建一个代码，它可以找到加泰罗尼亚语号码。但是在我的程序中可以是长数字。我找到了分子和分母。但我不能分割长数字!此外，只有标准库必须在此程序中使用。请帮帮我。这是我的代码
ios - 分配 NSInteger*
我确定我遗漏了一些明显的东西，但我想在 Objective C 中创建一个 NSInteger 指针的实例。 -(NSInteger*) getIntegerPointer{ NSInteger
ios - 分配/初始化只读属性
这个问题在这里已经有了答案: Difference between self.ivar and ivar? (4 个答案) 关闭 9 年前。
c++ - 分配 vector
我如何将 v[i] 分配给一系列整数(v 的类型是 vector )而无需最初填充最佳答案你的意思是将 std::vector 初始化为一系列整数？ int i[] = {1, 2, 3, 4,
c - 分配 - 指针到指针
我想寻求分配方面的帮助....我把这个作业带到了学校......我必须编写程序来加载一个 G 矩阵和第二个 G 矩阵，并搜索第二个 G 矩阵以获取存在数第一个 G 矩阵的......但是，当我尝试运行
c - 分配/取消分配资源
我必须管理资源。它基本上是一个唯一的编号，用于标识交换机中的第 2 层连接。可以有 16k 个这样的连接，因此每次用户希望配置连接时，他/她都需要分配一个唯一索引。同样，当用户希望删除连接时，资源(号
c - 分配/未分配字符串的命名约定
是否有任何通用的命名约定来区分已分配和未分配的字符串？我正在寻找的是希望类似于 us/s 来自 Making Wrong Code Look Wrong ，但我宁愿使用常见的东西也不愿自己动手。最佳
c - 如何解决以下函数中的内存分配问题？ (分配)
我需要读取一个 .txt 文件并将文件中的每个单词分配到一个结构中，该结构从结构 vector 指向。我将在下面更好地解释。感谢您的帮助。我的程序只分配文件的第一个字... 我知道问题出在函数 i

首页

博学

6Ren·AI

商城

c - 矢量化 strlen 摆脱读取未分配的内存