- iOS/Objective-C 元类和类别
- objective-c - -1001 错误,当 NSURLSession 通过 httpproxy 和/etc/hosts
- java - 使用网络类获取 url 地址
- ios - 推送通知中不播放声音
我只是好奇。我是新来的,所以请考虑我有点菜鸟的问题。
假设我正在开发带有图像识别功能的 android 应用程序,其中所有进程甚至计算密集型都必须在移动设备 cpu 上进行。
我正处于处理图像并从图像中提取一些特征的阶段。这组图像仅来自一座建筑物,它应该在其中识别特定的感兴趣对象(不同的 window 、图片、 Artifact 、建筑物外部)。所以这是一个封闭的领域,我可以提供足够多的不同角度的物体图片。我计划训练神经网络并将其提供给应用程序而不是图像匹配算法。
我的想法是提取关键点,计算描述符(使用 FREAK 作为关键点,使用 ORB 作为描述符),然后从这些描述符中我希望得到单个文件或数组最终会变成这样
Desc1 Desc2 Desc3 Desc4 DescN......... Class
_________________________________________________________________________________
Picture 1 0.121 0.923 0.553 0.22 0.28 "object1"
Picture 2 0.22 0.53 0.54 0.55 0.32 .........."object1" (different scale, angle)
Picture 3 .... ... ... ... .. .........."object2"
Picture N
Picture N+1
所以我可以将它交给神经网络进行训练,但是我被卡住了,因为我不知道矩阵(Class Mat - openCV)中的二进制特征/描述符是如何表示的。以及我将如何继续规范化这些二进制描述符,以便我可以将其提供给神经网络(多层感知器)进行训练。 (即使是伪代码也会有很大帮助)
最佳答案
我不能对你的问题给出完整的答案,因为我不熟悉神经网络,但我可以给你一些关于 ORB 描述符二进制表示的想法。
检测关键点时,FREAK 无法做到这一点。但是作为FREAK paper描述了你应该用 FAST corner detector 检测关键点,然后用 FREAK 描述它。如果你想通过 ORB 描述符识别对象,你应该同时使用 ORB,用于关键点检测和描述。请注意,ORB 关键点检测也可以基于 FAST。您可以通过更改 scoreType
的参数来更改它来自 OpenCV documentation .当您使用 android 时,您可以按照描述设置此参数 here
关于二进制字符串描述符。我还需要他们用 MySQL 查询实现描述符匹配器。由于 OpenCV-java 中的 Mat 只有双描述符表示,我已经实现了将它们转换为二进制的方法。为此,描述符的 Mat 应转换为 List<Double>
.您可以使用我的函数来获取描述符的二进制表示。该函数将返回 List<String>
.
代码如下:
public static List<String> descriptorToBinary(List<Double> desc){
List<String> binary_desc = new ArrayList<String>();
String desc_bin= "";
for(int i = 0; i < desc.size(); i++){
String binary_str_tmp = Integer.toBinaryString((int)((double)desc.get(i)));
if (binary_str_tmp.length() < 16)
{
int number_of_zeros = 16 - binary_str_tmp.length();
String str_tmp = "";
for(int t = 0; t < number_of_zeros; t++){
str_tmp += "0";
}
binary_str_tmp = str_tmp + binary_str_tmp;
}
desc_bin+= binary_str_tmp;
binary_desc.add(final_binary_str);
}
return binary_desc;
}
返回的字符串列表与 MatOfKeyPoint
的列表大小相同如果您将其转换为 List<KeyPoint>
那么我如何验证这些描述符是否正确:
因此与关键点相关联的二进制描述符将如下所示:
Picture 1: object1
keypoint1 : 512bit binary descriptor (1s and 0s)
keypoint2 : 512bit binary descriptor
keypoint3 : 512bit binary descriptor
...
Picture 2: object2
keypoint1 : 512bit binary descriptor
keypoint2 : 512bit binary descriptor
keypoint3 : 512bit binary descriptor
...
现在介绍多层感知器。我帮不了你。这就是为什么我一开始就说我的回答不完整。但我希望我给出的评论能帮助您将来解决您的问题。
关于java - 图像识别 - Mat 中的二进制描述符表示 - OpenCV Android,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/15399613/
我正在尝试将谷歌地图集成到 Xamarin Android。但是,如标题中所写,收到错误。此错误出现在我的 SetContentView (Resource.Layout.Main); 上,如下所示:
在 Delphi 中如何以非文本模式打开二进制文件?类似于 C 函数 fopen(filename,"rb") 最佳答案 有几个选项。 1。使用文件流 var Stream: TFileStrea
我现在正在处理一个问题,如下所示: 有两个数字 x1 和 x2 并且 x2 > x1。 例如 x1 = 5; x2 = 10; 而且我必须在二进制表示中找到 x1 和 x2 之间的总和。 5 = 10
我有这个“程序集”文件(仅包含 directives ) // declare protected region as somewhere within the stack .equiv prot_s
有没有办法在powershell中确定指定的文件是否包含指定的字节数组(在任何位置)? 就像是: fgrep --binary-files=binary "$data" "$filepath" 当然,
我是一名工程师,而不是软件程序员,所以请原谅我的无知。 我编写了一个 Delphi(7SE) 程序,用于从连接到两个数字温度计的 USB 端口读取“真实”数据类型。 我已经完成了该计划的大部分内容。
我有一些代码,例如: u=(float *)calloc(n, sizeof(float)); for(i=1; i
typedef struct pixel_type { unsigned char r; unsigned char g; unsigned char b;
如何判断二进制数是否为负数? 目前我有下面的代码。它可以很好地转换为二进制文件。转换为十进制时,我需要知道最左边的位是否为 1 以判断它是否为负数,但我似乎无法弄清楚该怎么做。 此外,我如何才能让它返
我有一个带有适当重载的 Vect*float 运算符的 vector 类,我正在尝试创建全局/非成员 float*Vect 运算符,如下所示:(注意这是一个经过大量编辑的示例) class Vect
对于使用 C 编程的项目,我们正在尝试将图像转换为二进制数据,反之亦然。我们在网上找到的所有其他解决方案都是用 C++ 或 Java 编写的。这是我们尝试过的方法: 将图像转换为包含二进制数据的文本文
我需要对列表的元素求和,其中包含所有零或一,如果列表中有 1,则结果为 1,否则为 0。 def binary_search(l, low=0,high=-1): if not l: retu
我到处搜索以找到将 float 转换为八进制或二进制的方法。我知道 float.hex 和 float.fromhex。是否有模块可以对八进制/二进制值执行相同的工作? 例如:我有一个 float 1
当我阅读有关 list.h 文件中的 hlist 的 FreeBSD 源代码时,我对这个宏感到困惑: #define hlist_for_each_entry_safe(tp, p, n, head,
我不知道出了什么问题,也不知道为什么会出现此错误。我四处搜索,但我终究无法弄明白。 void print_arb_base(unsigned int n, unsigned int b) {
在任何语言中都可以轻松地将十进制转换为二进制,反之亦然,但我需要一个稍微复杂一点的函数。 给定一个十进制数和一个二进制位,我需要知道二进制位是开还是关(真或假)。 示例: IsBitTrue(30,1
在下面的代码中,我创建了两个文件,一个是文本格式,另一个是二进制格式。文件的图标显示相同。但是这两个文件的特征完全相同,包括大小、字符集(==二进制)和流(八位字节)。为什么没有文本文件?因为如果我明
我想通读一个二进制文件。谷歌搜索“python binary eof”引导我here . 现在,问题: 为什么容器(SO 答案中的 x)不包含单个(当前)字节而是包含一大堆字节?我做错了什么? 如果应
为什么只允许以 10 为基数使用小数点?为什么以下会引发语法错误? 0b1011101.1101 我输入的数字是否有歧义?除了 93.8125 之外,字符串似乎没有其他可能的数字 同样的问题也适用于其
boost 库中有二进制之类的东西吗?例如我想写: binary a; 我很惭愧地承认我曾尝试找到它(Google、Boost)但没有结果。他们提到了一些关于 binary_int<> 的内容,但我既
我是一名优秀的程序员,十分优秀!