assembly - x86 指令是否需要它们自己的编码以及它们的所有参数同时存在于内存中？-6ren

assembly - x86 指令是否需要它们自己的编码以及它们的所有参数同时存在于内存中？

转载作者：行者123 更新时间：2023-12-01 23:23:48

26

4

我试图弄清楚是否有可能运行一个 Linux VM，其 RAM 仅由单个物理页面支持。

为了模拟这一点，我修改了 KVM 中的嵌套页面错误处理程序以删除
来自所有嵌套页表 (NPT) 条目的当前位，
除了对应于当前处理的页面错误的那个。

在尝试启动 Linux 客户机时，我观察到使用内存操作数的汇编指令，例如

add [rbp+0x820DDA], ebp

导致页面错误循环，直到我恢复包含页面的当前位
指令以及操作数中引用的页面(在本例中为 [rbp+0x820DDA] )。

我想知道为什么会这样。 CPU不应该顺序访问内存页面，即先读取指令然后访问内存操作数吗？
还是 x86 要求指令页和所有操作数页可以同时访问？

我正在 AMD Zen 1 上进行测试。

最佳答案

是的，它们确实需要机器代码和所有内存操作数。

Shouldn't the CPU access the memory pages sequentially, i.e. first read the instruction and then access the memory operand?

是的，逻辑上会发生这种情况，但是页面错误异常会中断该两步过程并丢弃任何进度。 CPU 无法记住发生页面错误时它在中间的指令是什么。

当页面错误处理程序在处理了有效页面错误后返回时，RIP= 错误指令的地址，因此 CPU 重新尝试从头开始执行它。

操作系统修改错误指令的机器码并期望它在 iret 之后执行不同的指令是合法的。来自页面错误处理程序(或任何其他异常或中断处理程序)。因此，AFAIK 在您所讨论的情况下，在架构上要求 CPU 从 CS:RIP 重新执行代码提取。 (假设它甚至确实返回到有故障的 CS:RIP，而不是在等待磁盘出现硬页面错误时调度另一个进程，或者在无效页面错误时将 SIGSEGV 传递给信号处理程序。)

管理程序进入/退出在架构上也可能是必需的。即使纸面上没有明确禁止，这也不是 CPU 的工作方式。

@torek 评论说，某些 (CISC) 微处理器会在页面错误时部分解码指令并转储微寄存器状态，但 x86 并非如此。

一些指令是可中断的并且可以取得部分进展，例如 rep movs (memcpy in a can) 和其他字符串指令，或收集负载/分散存储。但唯一的机制是更新架构寄存器，如用于字符串操作的 RCX/RSI/RDI，或用于收集的目标和掩码寄存器(例如 AVX2 vpgatherdd 的手册)。不将操作码/解码结果保留在一些隐藏的内部寄存器中，并在从页面错误处理程序 iret 之后重新启动它。这些是执行多个单独数据访问的指令。

还要记住，x86(像大多数 ISA 一样)保证指令是原子的。中断/异常:在中断之前，它们要么完全发生，要么根本不发生。 Interrupting an assembly instruction while it is operating .例如 add [mem], reg如果存储部分出现故障，即使没有 lock，也需要丢弃负载。前缀。

在最坏的情况下，存在的 guest 用户空间页面数量可能是 6 个(加上每个单独的 guest 内核页表子树):

movsq或 movsw跨越页面边界的 2 字节指令，因此需要两个页面才能对其进行解码。

qword 源操作数 [rsi]也是分页

qword 目标操作数 [rdi]也是分页

如果这 6 页中的任何一页出现错误，我们将回到第一页。
rep movsd也是一个 2 字节的指令，在它的一个步骤上取得进展会有相同的要求。类似案例如 push [mem]或 pop [mem]可以用未对齐的堆栈构造。

使收集加载/分散存储“可中断”(用其进度更新掩码向量)的原因(或附带好处)之一是避免增加此最小占用空间以执行单个指令。还可以提高在一次聚集或分散期间处理多个故障的效率。

@Brandon 在评论中指出 guest 将需要其内存中的页表 ，并且用户空间页面拆分也可以是 1GiB 拆分，因此两侧位于顶级 PML4 的不同子树中。 HW page walk 需要接触所有这些访客页面表页面才能取得进展。这种病态的情况不太可能偶然发生。

允许 TLB(和 page-walker 内部)缓存一些页表数据，并且不需要从头开始重新启动 page-walk，除非操作系统这样做 invlpg或者设置一个新的 CR3 顶级页面目录。将页面从不存在更改为存在时，这些都不是必需的；纸上的 x86 保证不需要它(因此不允许对不存在的 PTE 进行“负缓存”，至少对软件不可见)。因此，即使某些 guest 物理页表页面实际上不存在，CPU 也可能不会 VMexit。

PMU 性能计数器 可以启用和配置，以便指令也需要 写入 PEBS 缓冲区的性能事件 对于那个指令。将计数器的掩码配置为仅计算用户空间指令，而不是内核，很可能每次返回用户空间时它都会尝试使计数器溢出并将样本存储在缓冲区中，从而产生页面错误。

关于assembly - x86 指令是否需要它们自己的编码以及它们的所有参数同时存在于内存中？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/60968748/

26

4

0

文章推荐： java - java程序中if语句偏转时出错

文章推荐： java - 替换eclipse中的android.jar

文章推荐： emacs - Orgmode 标题级别高度

文章推荐： gdb 搜索核心转储内存

mysql - 连接的子查询(存在/存在)
SELECT *, `o_cheque_request.member_id`, `o_cheque_request.wallet_id` FROM `o_cheque_request`, `o_mem
SQL查找是否"存在"，别再count了！
根据某一条件从数据库表中查询『有』与『没有』，只有两种状态，那为什么在写SQL的时候，还要**SELECT count(*)**呢？无论是刚入道的程序员新星，还是精湛沙场多年的程序员老白，都是一如
c# - 存在、读写只需一步
我试图找出一个文件是否存在，如果存在，验证css样式是否已经存在，如果不存在，将它们写在文件末尾... 我已经完成了这一切，但分 3 个步骤: 该文件是否存在？ FileInfo fi= new Fi
android - 如何检测iOS用户或Android用户是否“存在”？
我们正在开发即时消息传递应用程序，并且需要在用户的化身上用绿点显示用户 friend 的“状态”。 “状态”远远超出了“my_app_is_opened_and_on_focus”，这意味着(我猜可能
SQL 查询不存在，存在
模式 Movie(title, year, director, budget, earnings) Actor(stagename, realname, birthyear) ActedIn(stag
MySQL 触发器语法错误 IF 存在
我有一个正在尝试创建的 MySQL 触发器，但无法获得正确的语法。触发器应该遍历一组关键字并将其与插入数据库的新帖子的标题进行匹配。如果找到匹配项，它应该将新帖子分配给该存储桶并更新存储桶的关键字集
MYSQL 选择子查询 IF 存在
我有 3 个表......用户、更新和碰撞。我想向发出 api 请求的用户返回最新订单的 feed 更新，并提供显示 feed 中每个状态所需的所有数据。我还需要包括更新是否已被发出 api 请求的
ios - UIViewController 存在
我正在尝试呈现一个带有 UIView 的 UIViewController。以下是我在 viewDidLoad 方法中尝试的代码。 //create the view controller UIVi
mysql - 如何在一个查询中进行多个计数/存在？
我正在努力弄清楚如何在不对 mysql 进行两次调用的情况下从一个表中检查两件事。我有一个 Members 表。我想测试MemberID 列中是否存在某个值，以及PhoneNumber 列中是否存在
vba - 循环没有 Do 错误但 Do 存在
以下代码给出了一个没有 Do Compile 错误的循环: Loop Sheets("Snap").Rows(1).AutoFilter Field:=5, Criteria1:=List
dns - 域名通过 "dig"存在
是否可以通过检查“dig”的输出来检查域名的存在？在绑定(bind)源中，我发现了这些常量: 0 DNS_R_NOEROR 1 DNS_R_FORMERR 2 DNS_R_SERVFAIL 3 DN
php - Controller 存在，但找不到页面
Controller 有问题我在 Windows 上使用服务器，一切正常，但在互联网上我试图访问页面 social_apartament/beauty_life/并且找不到该页面，代码错误 404这
d - 存在 `static if`时如何生成文档
/** This is struct S. */ struct S(T) { static if(isFloatingPoint!T) { /// This version works
clojure - 类型删除如何帮助 Clojure 存在？
JVM 类型删除如何帮助 Clojure？没有它，Clojure 还能存在吗？如果 JVM 有具体化的类型会发生什么？也就是说，Clojure 将如何改变？最佳答案 Clojure 根本不会有太大变
c - 为什么 system() 存在？
许多论文等提到对“system()”的调用是不安全且不可移植的。我不反对他们的论点。不过，我注意到许多 Unix 实用程序都有一个等效的 C 库。如果没有，源可用于各种这些工具。虽然许多论文和此类
javascript - js如何让一个变量值根据用户登录 Node 存在
在我的 Node js 应用程序中，我有一个用户登录 api。上面我在服务器端代码中创建了一个名为 customerid 的变量。现在，当用户身份验证成功时。我将他的 userid 值存储在我的 cu
azure - 存在 DNS 详细信息时重用资源管理器模板
我有一个工作资源管理器组，由 Ubuntu 14.04 虚拟机、网络接口(interface)、公共(public) IP 地址和存储帐户组成。我已经从这组资源中创建了一个模板。当我尝试部署这组资源
javascript - 存在 javascript 循环引用问题
我有一个函数createminor4(arr，锦标赛)它基本上将arr分成4组，每组8人，然后将它们一次交换到tourney 1组。从那里它插入四个{}，其中有 4 个带有空数组的键。我已经在 Ch
r - 存在 2 个图例时如何更改图例点的大小
我有一个图表，其中有两个图例。我需要更改其中一个图例的点的大小。我需要更改图例中“市场类型”的项目符号大小。我使用示例 here但不适用于我的图表。我的代码如下: k <- ggplot(subs
javascript - 存在 jQuery 字符串比较问题
我有 fiddle here展示我正在尝试做的事情。我有一个动态生成的表，因此列可以按用户选择的任何顺序显示。因此，我尝试获取两个特定 header 的索引，以便可以将 CSS 类添加到这两列以供稍

首页

博学

6Ren·AI

商城

assembly - x86 指令是否需要它们自己的编码以及它们的所有参数同时存在于内存中？