- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我将在 GNU 汇编程序 (GAS) 中为 Linux x86-64(特别是我 table 上的 AMD Ryzen 9 3900X)编写自己的 FORTH“引擎”。
(如果成功,我可能会用类似的想法为复古6502和类似的自制电脑制作固件)
我想添加一些有趣的调试功能,例如将编译代码的注释保存在带有附加字符串的“NOP words”中,这在运行时不会做任何事情,但是当反汇编/打印出已经定义的单词时,它会打印那些评论也一样,所以它不会丢失所有标题(a b - c)和评论(这里有这个特殊的小技巧)我将能够尝试用文档定义新词,然后以某种不错的方式打印所有定义并从中创建新的图书馆,我认为这很好。 (并且已经切换到忽略“生产发布”的评论)
我在这里阅读了太多关于优化的内容,但我无法在几周内理解所有这些内容,所以我将推出微优化,直到它遇到性能问题,然后我将开始分析。
但我想至少从体面的架构决策开始。
我目前的理解:
因为有很多“堆”在增长(好吧,没有使用“免费”,所以它也可能是堆栈,或者堆栈在增长)(还有两个堆栈在向下增长)我不确定如何实现它,因此 CPU 缓存将以某种方式适本地覆盖它。
我的想法是使用一个“大堆”(并在需要时用 brk() 增加它),然后在其上分配大块的对齐内存,在每个 block 中实现“小堆”并将它们扩展到另一个大堆当旧的填满时分块。
我希望,缓存会自动获得最常用的 block ,首先在大部分时间保留它,而较少使用的 block 将大部分被缓存忽略(相应地,它只会占据一小部分并被读取并全部踢出时间),但也许我没做对。
但也许对此有更好的策略?
最佳答案
进一步阅读的第一站应该是:
so I will put out microoptimalisation until it will suffer performance problems and then I will start with profiling.
是的,开始尝试可能很好,这样您就可以使用 HW 性能计数器进行分析,这样您就可以将您正在阅读的有关性能的内容与实际发生的事情相关联。因此,在您过度优化整体设计理念之前,您会获得一些您尚未想到的可能细节的想法。您可以从一些非常小规模的东西开始学习很多关于 asm 微优化的知识,比如某个地方没有任何复杂分支的单个循环。
由于现代 CPU 使用分离的 L1i 和 L1d 缓存以及一级 TLB,因此将代码和数据放在一起并不是一个好主意。 (尤其不是读写数据;自修改代码由 flushing the whole pipeline on any store too near any code that's in-flight anywhere in the pipeline 处理。)
相关:Why do Compilers put data inside .text(code) section of the PE and ELF files and how does the CPU distinguish between data and code? - 他们没有,只有经过混淆的 x86 程序才会这样做。 (ARM 代码有时会混合代码/数据,因为 PC 相关负载在 ARM 上的范围有限。)
是的,确保您所有的数据分配都在附近应该有利于 TLB 局部性。硬件通常使用伪 LRU 分配/逐出算法,该算法通常可以很好地将热数据保存在缓存中,通常不值得尝试手动 clflushopt
任何东西来帮助它。软件预取也很少有用,尤其是在数组的线性遍历中。如果您知道稍后要访问的位置,那么这样做有时是值得的,但 CPU 无法轻易预测。
AMD 的 L3 缓存可能会使用 adaptive replacement喜欢Intel does , 试图保留更多被重用的行,而不是让它们被那些往往不会被重用的行轻易驱逐。但是 Zen2 的 512kiB L2 以 Forth 标准比较大;您可能不会有大量的二级缓存未命中。 (并且无序执行可以做很多事情来隐藏 L1 未命中/L2 命中。甚至隐藏 L3 命中的一些延迟。)当代 Intel CPU 通常使用 256k L2 缓存;如果您是通用现代 x86 的缓存阻塞,128kiB 是一个不错的 block 大小选择,假设您可以写入然后在获得 L2 命中时再次循环。
在像 Zen2 ( https://en.wikichip.org/wiki/amd/microarchitectures/zen_2#Architecture ) 或 Skylake 这样的现代 x86 上,L1i 和 L1d 缓存(每个 32k),甚至 uop 缓存(高达 4096 微指令,每条指令大约 1 或 2),与第四实现;可能大部分时间所有内容都会命中 L1 缓存,当然还有 L2。是的,代码局部性通常很好,但是 L2 缓存比典型 6502 的整个内存还多,您真的不必担心太多 :P
解释器更关心的是分支预测,但幸运的是 Zen2(以及自 Haswell 以来的英特尔)有 TAGE 预测器,即使只有一个“大中央调度”分支,它也能很好地学习间接分支的模式:Branch Prediction and the Performance of Interpreters -Don’t Trust Folklore
关于assembly - AMD64 缓存优化策略 - 堆栈、符号、变量和字符串表,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/67841704/
给定一个字符串,例如 s="##$$$#",我如何找到索引之前的“#”符号数等于“”数的索引$"符号在索引之后? 示例:如果 s="##$$$#",则输出将为 2。 解释:在索引 2 之前我们有 2
在本教程中,您将借助示例了解 JavaScript 符号。 JavaScript 符号 JavaScript ES6 引入了一种新的原始数据类型,称为 Symbol(符号)。符号是不可变的(不能更改)
在“函数编程的工艺”一书中,符号 '>.>' 将函数连接在一起,与 '.' 的方向相反。但是当我使用 ghci 实现它时,它显示了超出范围的错误 '>.>'。为什么?它是不再使用的旧符号吗? 最佳答案
很难说出这里问的是什么。这个问题是含糊的、模糊的、不完整的、过于宽泛的或修辞性的,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开它,visit the help center 。 已关
我需要从向量中删除 \"。这是我的数据: data <- c("\"https://click.linksynergy.com/link?id=RUxZriH*PWc&offerid=323058.1
我在 Nginx 配置中使用正则表达式来捕获文件 URL,但如果文件 URL 包含 # 符号,正则表达式模式将不会捕获它。 这里是nginx的配置部分。 location ~ ^/p/(?[\w\-=
如何使 & 符号在此图表的第一组条形/列下正确显示: http://jsfiddle.net/VxbrK/2/ 应该是“Apples & Oranges”而不是“Apples & Oranges”。
**在verilog中是什么意思? 我为测试台提供了以下逻辑 localparam NUM_INPUT_BITS = 1; localparam NUM_OUTPUT_BITS
我有一个使用正则表达式来验证电子邮件地址的方法。 public String searchFormail(String searchWord) { Pattern pattern = Patt
我想将一个字符串拆分为数字部分和文本/符号部分我当前的代码不包含负数或小数,并且表现得很奇怪,在输出的末尾添加了一个空列表元素 import re mystring = 'AD%5(6ag 0.33-
我有一些代码需要从数组中选择一个随机字符串,但它一直返回单个字母或数字。如何解决这个问题? var name = ["Yayek", "Vozarut", "Gezex",
我刚开始使用 Python,我在考虑应该使用哪种表示法。我读过 PEP 8关于 Python 符号的指南,我同意那里的大多数内容,除了函数名称(我更喜欢混合大小写风格)。 在 C++ 中,我使用匈牙利
在用 C# 编写代码时,我错误地在 if 语句中的变量前添加了一个符号(而不是感叹号)。 bool b = false; if (@b) { } 我很惊讶它编译成功,没有任何错误。 我想知道:上面的代
本文实例为大家分享了特殊字符替换电话号码中某一部分的方法,ios利用-号替换电话号码中间四位,供大家参考,具体内容如下 1、效果图 2、代码 rootviewcontroll
当我使用“x”和“z”作为符号时,这段代码没有问题: from sympy import * x, z = symbols('x z') y = -6*x**2 + 2*x*z**0.5 + 50*x
我需要从文本中删除标点符号: data <- "Type the command AT&W enter. in order to save the new protocol on modem;"
我有几个数字是 numeric 类。下面的例子。 df = c(12974,12412,124124,124124,34543,4576547,32235) 现在我想在每个数字前添加 '$' 符号而不
我有一个 highcharts 图例,其中符号以不同的大小显示,因为它们在实际图表中的大小不同。不幸的是,当数据点的大小增加时,它们也会在图例中增加。无论数据点大小如何,我都希望图例符号保持相同的大小
我需要使用包含平均值+-SD的标题。到目前为止,我只能得到以下信息: "Mean +- SD or N (%)" [1] "Mean +- SD or N (%)" 如何直接使用“+-”符号?您知道一
使用 XSLT 和 XPath 1.0,我有一个要转义的字符串以用于 URL,例如: one word & another 因此,描述元素的 text() 应该进行 URL 转义。 我该怎么做
我是一名优秀的程序员,十分优秀!