ios - Compute Kernel Metal - 如何检索结果和调试？-6ren

ios - Compute Kernel Metal - 如何检索结果和调试？

转载作者：行者123 更新时间：2023-12-01 19:38:59

24

4

我已经下载了苹果的 truedepth 流媒体示例，并正在尝试添加计算管道。我想我正在检索计算结果，但不确定，因为它们似乎都为零。

我是iOS开发的初学者，所以可能会有很多错误，请多多包涵!

管道设置:(我不太确定如何创建结果缓冲区，因为内核输出一个 float3)

int resultsCount = CVPixelBufferGetWidth(depthFrame) * CVPixelBufferGetHeight(depthFrame);

//because I will be output 3 floats for each value in depthframe
id<MTLBuffer> resultsBuffer = [self.device newBufferWithLength:(sizeof(float) * 3 * resultsCount) options:MTLResourceOptionCPUCacheModeDefault];


_threadgroupSize = MTLSizeMake(16, 16, 1);

// Calculate the number of rows and columns of threadgroups given the width of the input image
// Ensure that you cover the entire image (or more) so you process every pixel
_threadgroupCount.width  = (inTexture.width  + _threadgroupSize.width -  1) / _threadgroupSize.width;
_threadgroupCount.height = (inTexture.height + _threadgroupSize.height - 1) / _threadgroupSize.height;

// Since we're only dealing with a 2D data set, set depth to 1
_threadgroupCount.depth = 1;

id<MTLComputeCommandEncoder> computeEncoder = [commandBuffer computeCommandEncoder];

[computeEncoder setComputePipelineState:_computePipelineState];

[computeEncoder setTexture: inTexture atIndex:0];

[computeEncoder setBuffer:resultsBuffer offset:0 atIndex:1];

[computeEncoder setBytes:&intrinsics length:sizeof(intrinsics) atIndex:0];

[computeEncoder dispatchThreadgroups:_threadgroupCount
                       threadsPerThreadgroup:_threadgroupSize];

[computeEncoder endEncoding];


// Finalize rendering here & push the command buffer to the GPU
[commandBuffer commit];

//for testing
[commandBuffer waitUntilCompleted];

我添加了以下计算内核:

kernel void
calc(texture2d<float, access::read>  inTexture  [[texture(0)]],
                device float3 *resultsBuffer [[buffer(1)]],
                constant float3x3& cameraIntrinsics [[ buffer(0) ]],
                uint2 gid [[thread_position_in_grid]])
{

    float val = inTexture.read(gid).x * 1000.0f;

    float xrw = (gid.x - cameraIntrinsics[2][0]) * val / cameraIntrinsics[0][0];
    float yrw = (gid.y - cameraIntrinsics[2][1]) * val / cameraIntrinsics[1][1];

    int vertex_id = ((gid.y * inTexture.get_width()) + gid.x);

    resultsBuffer[vertex_id] = float3(xrw, yrw, val);

}

查看缓冲区结果的代码:(我尝试了两种不同的方法，目前都输出全零)

    void *output = [resultsBuffer contents];
    for (int i = 0; i < 10; ++i) {
        NSLog(@"value is %f", *(float *)(output) ); //= *(float *)(output + 4 * i);
    }

    NSData *data = [NSData dataWithBytesNoCopy:resultsBuffer.contents length:(sizeof(float) * 3 * resultsCount)freeWhenDone:NO];
    float *finalArray = new float [resultsCount * 3];
    [data getBytes:&finalArray[0] length:sizeof(finalArray)];
    for (int i = 0; i < 10; ++i) {
        NSLog(@"here is output %f", finalArray[i]);
    }

最佳答案

我在这里看到了几个问题，但它们都与您的 Metal 代码本身无关。

在您的第一个输出循环中，如所写，您只是将结果缓冲区的第一个元素打印 10 次。第一个元素可能合法地为 0，导致您相信所有结果都为零。但是当我将第一条日志行更改为

NSLog(@"value is %f", ((float *)output)[i]);

在测试镜像上运行内核时，我看到打印了不同的值。

另一个问题与您的 getBytes:length: 有关。称呼。您想传递要复制的字节数，但是 sizeof(finalArray)实际上是 finalArray 的大小指针 ，即 4 个字节，而不是它指向的缓冲区的总大小。这是 C 和 C++ 代码中极为常见的错误。

相反，您可以使用与分配空间时使用的字节数相同的字节数:

[data getBytes:&finalArray[0] length:(sizeof(float) * 3 * resultsCount)];

然后，您应该会发现打印的值与上一步相同(非零)。

关于ios - Compute Kernel Metal - 如何检索结果和调试？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/58228297/

24

4

0

文章推荐： Java:尝试将大于 127 的字节添加到 ByteBuffer

文章推荐： java - 当该程序显示无法找到或加载主类时，如何使该程序运行？

文章推荐： kotlin - ArgumentCaptor 与 InOrder 使用不同参数验证后续回调

文章推荐： ios - Objective-C - 读取 JSON key 时的问题

java - 调试 "Step into"类调用导致 "Class not found"异常 - Eclipse 调试
昨晚我因为这个问题脑子崩溃了。在确保没有来 self 的 eclipse 错误检查的明显错误之后，我开始调试我的程序。顺便说一下，我正在使用 Jre7。无论如何，每次我进入我的类调用(我们称之为“a”
gcc - 是否可以使用 lldb 调试 gcc 编译的程序，或使用 gdb 调试 clang 编译的程序？
(前言:我对 C/C++ 还很陌生，我真的不知道 native 代码中的调试实际上是如何工作的。) 一些消息来源说 gdb 和 lldb 可以调试 any program compiled to ma
debugging - 调试 T4Scaffolding.Core Nuget 包时的 Set-DefaultScaffolder : Cannot get an instance of EnvDTE. DTE - 高级 Powershell 调试
我正在尝试从 Visual Studio 2012 外部调试 T4Scaffolding.Core Nuget 包。我使用的是安装了 Powershell 3.0 的 Powershell ISE，并
调试 assembly
如何调试汇编代码？我在 Linux 上使用 gdb。我知道我可以看寄存器。有哪些调试汇编代码的方法？最佳答案您当然可以使用 breakpoints就像 C 或任何其他编译语言一样。 This ar
Haskell 调试
如何在每次通话时打印列表或 haskell 中的内容，例如: funct a list = funct (a + 1) (a : list) print list her
调试 Makefile
让我用我对 Makefiles 或 make 知之甚少的评论作为这个问题的前缀。有一个非常大的项目，每晚自动构建。它以 Debug 和 Release 模式构建，Debug 用于 Valgrind
计算周薪和加类费的C程序不起作用？调试
我正在创建一个计算每周工资的程序，那么任何加类工资都是该周正常工资的 1.5 倍。我的代码如下: #include int main() { double payrate; double h
JavaScript 调试
我使用的是 Visual Studio 2010 Express Developer 版本。开发网站。我在我的 .aspx 页面中使用 JavaScript。如何在 Javascript 中放置断点
Javascript 调试
我最近开始修补 Project Euler 问题，并尝试用 Javascript 解决它们。这样做我往往会产生许多无限循环，现在我想知道是否有比终止 Firefox 或 Chrome 中的选项卡更好的
Python实时编码/调试
有没有办法在程序执行期间生成一个交互式 python 控制台(最好是 iPython)而不暂停主程序并且能够检查和修改程序变量？类似于浏览器为 JavaScript 提供的功能。我知道 pdb.se
android - 调试 FFmpeg
我正在使用 FFmpeg @ Android 并希望能够进入 FFmpeg 代码(Eclipse + Seqouya)，同时编译 FFmpeg 我使用 --disable-stripping --en
.net - 调试.net进程时如何找到LastError的值？
我从使用互操作调用 win32 api 函数的 .net 进程中得到一个异常。我有一个调试器，我想查看 LastError 的值。是否可以从 Visual Studio 调试器中查看 LastEr
vba - Navigate2 调试
我正在尝试通过 VBA 创建一个宏，以在 IE 的多个选项卡中打开一组指定的链接。目前我正在使用下面的代码，如果我试图打开 3 个或更少的选项卡，它大部分时间都可以工作。任何超过 3 的代码都会在“N
debugging - MonoDevelop 调试？
好的，这似乎是一个愚蠢的问题，因为 MonoDevelop 越来越成熟，所以我确定我只是想念它，但我环顾四周，所有关于这个主题的问题似乎都是关于远程调试或 Mac 上的调试。我使用的是 Ubuntu
调试 littler/Rscripts
如何调试 Rscripts是从命令行运行的？我目前正在使用 getopt传递命令行选项的包，当有错误时，我很难: 看看到底出了什么问题；在 R 中交互式调试(因为脚本需要命令行选项。) 有没有人有
Adobe ExtendScript 调试
支持 PDF 和网络上的信息很少。我碰巧在博客中看到一篇文章，提到 $.write() 或 $.writeln() 将向 javascript 控制台写入一个字符串。相当有用。有谁知道这个 $ 对象是
PyCharm JavaScript 调试
PyCharm 1.5 中是否可以使用 Firefox 和 Chrome 支持的 JavaScript 调试？如果是这样，它能否与 Python/Django 调试器一起有效运行？如果没有，有没有
debugging - 调试 Release模式应用程序的最佳方法
我确定这以前发生在人们身上，某些东西在 Debug模式下工作，你在发布时编译，但有些东西坏了。这发生在我在嵌入式 XP 环境中工作时，我发现最好的方法确实是编写一个日志文件来确定它会出错的地方。您
php - Flow3 调试
我目前正在为即将到来的项目评估 Flow3。 AOP 模式和依赖注入(inject)将非常适合我们的目的。现在我想不通的是如何在 Controller Action 中调试一些结果。 public
Django Gunicorn 调试
最初，我有一个包含测试服务器的 Django 应用程序。要调试此设置，我只需添加 import pdb; pdb.set_trace()代码中的任何位置，并且有一个断点将我扔到终端中的交互式调试器中(

首页

博学

6Ren·AI

商城

ios - Compute Kernel Metal - 如何检索结果和调试？