- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个简单的基于浮点的操作,它总是执行两次。所以我试图将它翻译成 SSE,但它只是失败了。高级语言是Delphi,不支持Intrinsics函数,只好自己写。基本上我只有参数加载/卸载和一些乘法和加法。:
Procedure TLP1Poly2.Process(Const _a1, _b1, _OldIn1, _OldIn2, _OldOut1, _OldOut2: Double; Var Sample1, Sample2: Double);
Asm
MOVLPD XMM4, _a1
MOVHPD XMM4, _a1
MOVLPD XMM3, _b1
MOVHPD XMM3, _b1
//
MOVLPD XMM0, [Sample1]
MOVHPD XMM0, [Sample2]
MULPD XMM0, XMM4
//
MOVLPD XMM1, _OldIn1
MOVHPD XMM1, _OldIn2
MULPD XMM1, XMM4
//
MOVLPD XMM2, _OldOut1
MOVHPD XMM2, _OldOut2
MULPD XMM2, XMM3
//
ADDPD XMM0, XMM1
ADDPD XMM0, XMM2
//
MOVLPD [Sample1], XMM0
MOVHPD [Sample2], XMM0
//
// which stands for twice this:
// Sample:= Sample*a1 + oldinp*a1 + oldout*b1;
//
End;
但此过程不起作用,如果我“nop”Sample1/Sample2 加载/保存之间的所有内容,则没问题,但否则我的过滤器将保持静音。在这方面我没有得到 SSE 的基本内容是什么?
附录:
旧类(class):
constructor TLP1.create;
begin
oldfreq := -1 ;
end;
procedure TLp1.process(inp,Frq,SR :single);
begin
if Frq<>oldfreq then
begin
a := 2* SR;
t := Frq * _ppi;
n := 1/ (a+t) ;
b1:= (a - t) * n;
a1:= t * n;
oldfreq := frq;
end;
outlp := (inp+_kd)*a1 + oldinp*a1 + oldout*b1;
oldout := outlp ;
oldinp := inp;
end;
新类(class):
Procedure TLP2Poly2.SetSamplerate(Const Value: Single);
Begin
If Value = FSamplerate Then Exit;
FSamplerate := Value;
UpdateCoefficients;
End;
Procedure TLP2Poly2.SetFrequency(Const Value: Single);
Begin
If Value = FFrequency Then Exit;
FFrequency := Value;
UpdateCoefficients;
End;
Procedure TLP2Poly2.UpdateCoefficients;
Var
a,t,n: Single;
Begin
a := 2 * FSamplerate ;
t := FFrequency * 2 * pi;
n := 1/ (a+t) ;
b1:= (a - t) * n;
a1:= t * n;
End;
Procedure TLP2Poly2.Process(Var Sample1, Sample2: Double);
Var
o1, o2: Double;
Begin
o1 := Sample1;
o2 := Sample2;
IntProcess( a1, b1, OldIn1, OldIn2, OldOut1, OldOut2, Sample1, Sample2);
OldOut1 := Sample1;
OldOut2 := Sample2;
OldIn1 := o1;
OldIn2 := o2;
End;
Procedure TLP2Poly2.IntProcess(Const _a1, _b1, _OldIn1, _OldIn2, _OldOut1, _OldOut2: Double; Var Sample1, Sample2: Double);
Asm
MOVLPD XMM4, _a1
MOVHPD XMM4, _a1
MOVLPD XMM3, _b1
MOVHPD XMM3, _b1
//
MOVLPD XMM0, [Sample1]
MOVHPD XMM0, [Sample2]
MULPD XMM0, XMM4
//
MOVLPD XMM1, _OldIn1
MOVHPD XMM1, _OldIn2
MULPD XMM1, XMM4
//
MOVLPD XMM2, _OldOut1
MOVHPD XMM2, _OldOut2
MULPD XMM2, XMM3
//
ADDPD XMM0, XMM1
ADDPD XMM0, XMM2
//
MOVLPD [Sample1], XMM0
MOVHPD [Sample2], XMM0
End;
最佳答案
在为 Delphi 编写汇编程序时,尤其是在 64 位模式下,您应该始终了解参数的传递方式。我从不使用前 4 个参数的名称,因为它们无论如何都在寄存器中。我直接使用这些寄存器。
请注意,_a1
、_b1
、_oldIn1
和 _oldIn2
是在 XMM0 - XMM3 分别,因此您的代码的第一部分会覆盖其中一些寄存器。例如,使用 _b1
加载 XMM3 会覆盖 _oldIn2
。 XMM2 也是如此,它包含 _oldIn1
。
重新安排您的寄存器使用是有意义的,这样您就不必使用内存存储作为中间。
IOW,尝试类似(未经测试)的方法:
asm
MOVDDUP XMM0,XMM0
MOVDDUP XMM1,XMM1
MOVLPD XMM4,[Sample1]
MOVHPD XMM4,[Sample2]
MULPD XMM4,XMM0
// etc...
关于delphi - 使用 SSE2 在 Delphi 中内联汇编低效程序,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/7909130/
我试图在图形模式下打印一个字符。通常当我打印我正在做的一个字符时: mov ah,14 ; ah=14 mov al,'x' int 10h ; print the character 这
我试图通过更改其中的一个字节来修改存储在内存中的字符串。我为此使用了 movb,但由于某种原因,给定内存位置的字节没有改变。 在 gdb 调试器上: 14 movb %al, (%r10) # nex
我一直在阅读一些汇编代码,并且开始发现调用指令实际上是与程序计数器相关的。 但是,每当我使用 Visual Studio 或 Windbg 进行调试时,它总是显示 call 0xFFFFFF ...这
我最近一直在使用 Visual C++ 中的内联汇编,我想知道是否可以直接向堆栈上的局部变量添加值,例如: push 5 add [esp], 7 这样做可以吗?我问这个问题是因为我在执行此操作时随机
我有下一个代码: mov al, -5 add al, 132 add al, 1 据我检查,溢出标志和进位标志将在第一个操作中设置,而在第二个操作中,仅设置溢出。 但我不明白为什么: 在无符号数中,
在 64 位 x86 汇编 nasm 中,如何将单个字节从寄存器移动到 .data 节中定义的内存位置? 我知道这有效 global _main section .data quotient db 0
我的汇编代码有问题。我想打印存储在寄存器 cx 中的数字,但是当我尝试打印它时,它打印的是 ascii 字符而不是 ascii 数字,所以我决定编写一个程序将 ascii char 转换为 ascii
为什么第 1B 行的跳转指令(例如)变成了 EBBD? 我知道“jmp”= EB但是BD是怎么计算的呢? 最佳答案 短跳转使用一个带符号的偏移量添加到 JMP 之后的指令地址。 例如,第一个 JMP
以下两者有什么区别: mov eax, [eax+4] 和 add eax, 4 mov eax, [eax] 如果不是,那么汇编器是否会选择哪个来进行某种优化? 最佳答案 这
看《The Shellcoder's Handbook》中的一些汇编和反汇编代码,发现一条指令的序列操作数是不一样的。 例如,在 assembly 上: mov ebx,0 并且,在反汇编时: mov
我有这个非常简单的汇编代码: start: add ax, 100 ; if ax overflow add to bx 1 jmp start 但我不知道如何检测 ax 寄存器溢出,有人可以帮
在 64 位 x86 汇编 nasm 中,如何将单个字节从寄存器移动到 .data 节中定义的内存位置? 我知道这有效 global _main section .data quotient db 0
我的汇编代码有问题。我想打印存储在寄存器 cx 中的数字,但是当我尝试打印它时,它打印的是 ascii 字符而不是 ascii 数字,所以我决定编写一个程序将 ascii char 转换为 ascii
我正在学习一些关于操作系统开发的教程,我发现了一篇关于多重引导 header 。这些是您必须定义的一些“神奇”值才能使用GRUB2。这些是命令: # Declare constants used f
为什么第 1B 行的跳转指令(例如)变成了 EBBD? 我知道“jmp”= EB但是BD是怎么计算的呢? 最佳答案 短跳转使用一个带符号的偏移量添加到 JMP 之后的指令地址。 例如,第一个 JMP
我正在尝试从内存中复制一些单词并使用汇编将其保存到另一个内存地址。我正在尝试为其编写代码,但我不确定其中的某些部分。我将简要描述我想要做什么。 源地址、目标地址和要复制的字数是函数的输入参数。 最佳答
当我们想要像这样创建一个初始化变量时: name db 'zara ali' 我们创建了一个字节大小变量,但我们在其中存储了一个字符串 这怎么可能?? 当我们使用这条指令时: MOV ecx, nam
我还是汇编的新手,我还不知道汇编中的许多命令代码。我想在 16 位寄存器中进行除法。我想打印它的内容。我知道我需要将寄存器的内容转换为 ASCII 进行打印,但同样,我的问题是除法。请帮我。 比如cx
使用有什么区别: c.eq.s $1, $2 bc1t L2 并使用: beq $1, $2, L2 如果他们做同样的事情,为什么有两种分支方式?如果它们不同,那么它们各自的好处是什么
源代码: int main() { int i; for(i=0, i : push rbp 2. 0x000055555555463b :
我是一名优秀的程序员,十分优秀!