tensorflow - 为什么使用 Faster RCNN 在 GPU 上进行自定义对象检测的预测率如此低 25

tensorflow - 为什么使用 Faster RCNN 在 GPU 上进行自定义对象检测的预测率如此低 25 - 40 [sec/1]？

转载作者：行者123 更新时间：2023-11-30 08:26:49

26

4

我已经训练了一个用于自定义对象检测的 faster_rcnn_inception_resnet_v2_atrous_coco 模型(可用 here )。

为了进行预测，我使用了对象检测演示 jupyter notebook file在我的图像上。还检查了每个步骤消耗的时间，发现 sess.run 一直占用时间。

但在 GPU 上预测 (3000 x 2000) 像素大小(大约 1-2 [MB])的图像大约需要25-40 [秒]。

有人能找出这里的问题吗？

我已经进行了分析，下载链接profiling file

完整链接profiling

系统信息:
使用 Standard_NV6(详细信息 here)在 Azure 门户中创建的虚拟机上进行训练和预测，该虚拟机使用 NVIDIA Tesla M60 GPU

操作系统平台和分发 - Windows 10
TensorFlow 安装自 - 使用 pip pip3 install --upgrade tensorflow-gpu
TensorFlow 版本 - 1.8.0
Python 版本 - 3.6.5
GPU/CPU - GPU
CUDA/cuDNN 版本 - CUDA 9/cuDNN 7

最佳答案

Can anyone figure out the problem here ?

很抱歉在这里残酷地开放和直接公平

观察到的性能问题的根本原因是:

对于这样一个计算密集型(性能和吞吐量驱动)任务，我们无法从 Azure 产品组合中找到更糟糕的 VM 设置。根本不能 - 菜单上没有“较少”配备的选项。

Azure NV6 的营销目标明确是为了虚拟桌面用户的利益，其中 NVidia GRID^(R) 驱动程序提供了软件层用于“共享”图像/视频虚拟化 FrameBuffer 部分(桌面图形像素、最大 SP endecs)的服务，在用户团队之间共享，无论其终端设备如何(然而，每个板载设备最多 15 个用户) GPU，它在 Azure 上专门明确地宣传和推广，将其作为其关键卖点。NVidia 甚至成为继父，明确针对(引用)Office 用户推广该设备强>)。

M60 缺乏(显然，因为已针对非常不同的分割市场进行了定义)任何智能 AI/ML/DL/张量处理功能，与 AI/ML/DL/张量处理专用计算 GPU 设备相比，DP性能低约 20 倍。

如果我可以引用的话，

... "GRID" is the software component that lays over a given set of Tesla ( Currently M10, M6, M60 ) (and previously Quadro (K1 / K2)) GPUs. In its most basic form (if you can call it that), the GRID software is currently for creating FrameBuffer profiles when using the GPUs in "Graphics" mode, which allows users to share a portion of the GPUs FrameBuffer whilst accessing the same physical GPU.

和

No, the M10, M6 and M60 are not specifically suited for AI. However, they will work, just not as efficiently as other GPUs. NVIDIA creates specific GPUs for specific workloads and industry (technological) areas of use, as each area has different requirements._{( credits go to BJones )}

下一步，
如果确实愿意在这个先验已知的最差选择上花费精力:

make sure that both GPUs are in "Compute" mode, NOT "Graphics" if you're playing with AI. You can do that using the Linux Boot Utility you'll get with the correct M60 driver package after you've registered for the evaluation. _{( credits go again to BJones )}

显然对于非 Linux/Azure 操作的虚拟化访问设备似乎没有这样的选项。
<小时/>
简历:
如果努力提高性能和吞吐量，最好选择另一个配备 AI/ML/DL/张量处理的 GPU 设备，这两个问题 -放置了特定的计算硬件资源，并且没有软件层(没有 GRID，或者至少有一个易于使用的禁用选项)，这在任何意义上都会阻止实现如此高级的 GPU 处理水平性能。

关于tensorflow - 为什么使用 Faster RCNN 在 GPU 上进行自定义对象检测的预测率如此低 25 - 40 [sec/1]？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/50676548/

26

4

0

文章推荐： javascript - 特定网址的 Angular 路由

文章推荐： javascript - 动态更改 ng-click 值

css - 自定义 ID 元素 + 自定义 CSS
好的，所以我编辑了以下... 只需将以下内容放入我的 custom.css #rt-utility .rt-block {CODE HERE} 但是当我尝试改变... 与 #rt-sideslid
ios - 自定义 tableview 单元格的问题。自定义 tableview 单元格内的 Collectionview 未根据单元格的高度进行调整
在表格 View 中，我有一个自定义单元格(在界面生成器中高度为 500)。在该单元格中，我有一个 Collection View ，我按 (10,10,10,10) 固定到边缘。但是在 tablev
swift - 如何使用鼠标在另一个 IB 自定义 View 中进入/退出来控制一个 IB 自定义 View
对于我的无能，我很抱歉，但总的来说，我对 Cocoa、Swift 和面向对象编程还很陌生。我的主要来源是《Cocoa Programming for OS X》(第 5 版)，以及 Apple 的充满
python - 自定义 Python Wheel 文件的 Yocto Warrior 自定义 Bitbake 配方无法安装，因为找不到 pip3
我正在使用 meta-tegra 为我的 NVIDIA Jetson Nano 构建自定义图像。我需要 PyTorch，但没有它的配方。我在设备上构建了 PyTorch，并将其打包到设备上的轮子中。现
jquery序列化()+自定义？
在 jquery 中使用 $.POST 和 $.GET 时，有没有办法将自定义变量添加到 URL 并发送它们？我尝试了以下方法: $.ajax({type:"POST", url:"file.php?
自定义 Traefik（本地）插件
Traefik 已经默认实现了很多中间件，可以满足大部分我们日常的需求，但是在实际工作中，用户仍然还是有自定义中间件的需求，为解决这个问题，官方推出了一个 Traefik Pilot[1] 的功
android - 自定义 TextInputLayout
我想让我的 CustomTextInputLayout 将 Widget.MaterialComponents.TextInputLayout.OutlinedBox 作为默认样式，无需在 XML 中
Emacs rgrep 自定义
我在 ~/.emacs 中有以下自定义函数: (defun xi-rgrep (term) (grep-compute-defaults) (interactive "sSearch Te
excel - 自定义 SUMPRODUCT()
我有下表: 考虑到每个月的权重，我的目标是在 5 个月内分散 10,000 个单位。与 10,000 相邻的行是我最好的尝试(我在这上面花了几个小时)。黄色是我所追求的。我试图用来计算的逻辑如下:计
自定义 Joomla 组件的文件上传表单
我的表单中有一个字段，它是文件类型。当用户点击保存图标时，我想自然地将文件上传到服务器并将文件名保存在数据库中。我尝试通过回显文件名来测试它，但它似乎不起作用。另外，如何将文件名添加到数据库中？是在模
Python邮箱 "from name"自定义
我有一个 python 脚本来发送电子邮件，它工作得很好，但问题是当我检查我的电子邮件收件箱时。我希望该用户名是自定义用户名，而不是整个电子邮件地址。最佳答案发件人地址应该使用的格式是: You
r - 自定义 ggcorrplot
我想减小 ggcorrplot 中标记的大小，并减少文本和绘图之间的空间。 library(ggcorrplot) data(mtcars) corr <- round(cor(mtcars), 1)
gtk - 自定义 GtkFileChooser
GTK+ noob 问题在这里: 是否可以自定义 GtkFileChooserButton 或 GtkFileChooserDialog 以删除“位置”部分(左侧)和顶部的“位置”输入框？我实际上要
Magento 自定义 block
我正在尝试在主页上使用 ajax 在 magento 中使用 ajax 显示流行的产品列表，我可以为 5 或“N”个产品执行此操作，但我想要的是将分页工具栏与结果集一起添加. 这是我添加的以显示流行产
Django 自定义 PasswordResetForm
我正在尝试使用 PasswordResetForm 内置函数。由于我想要自定义表单字段，因此我编写了自己的表单: class FpasswordForm(PasswordResetForm):
Angular:拖放树 - 自定义
据我了解，新的 Angular 7 提供了拖放功能。我搜索了有关 DnD 的 Tree 组件，但没有找到与树相关的内容。我在 Stackblitz 上找到的一个工作示例.对比drag'ndrop功能
WPF 自定义 TabControl
我必须开发一个自定义选项卡控件并决定使用 WPF/XAML 创建它，因为我无论如何都打算学习它。完成后应该是这样的: 到目前为止，我取得了很好的进展，但还有两个问题: 只有第一个/最后一个标签项应该有
r - 自定义 xtable
我要定制xtable用于导出到 LaTeX。我知道有些问题是关于 xtable在这里，但我找不到我要找的具体东西。以下是我的表的外观示例: my.table <- data.frame(Specif
ejs - EJS中的日期时间格式/自定义
用ejs在这里显示日期它给我结果 Tue Feb 02 2016 16:02:24 GMT+0530 (IST) 但是我需要表现为 19th January, 2016 如何在ejs中执行此操作？
JavaFX 自定义 ListView
我想问在 JavaFX 中使用自定义对象制作 ListView 的最佳方法，我想要一个每个项目如下所示的列表: 我搜了一下，发现大部分人都是用细胞工厂的方法来做的。有没有其他办法？例如使用客户 fxm

首页

博学

6Ren·AI

商城