- c - 在位数组中找到第一个零
- linux - Unix 显示有关匹配两种模式之一的文件的信息
- 正则表达式替换多个文件
- linux - 隐藏来自 xtrace 的命令
我在 Windows 7 64 位机器上使用 Windows 的 Caffe 框架(从 here 下载)。我在 Visual Studio Community 2013 中使用 C++。我使用预训练的 GoogLeNet 模型提取 loss1-fc 层输出以用作每个图像的特征向量。到目前为止一切顺利。
最近我尝试更改我的软件以用于视频帧。所以我将第一层从 ImageData 层更改为 Memory 层,这样我就可以向 Caffe 发送一个 OpenCV 垫的 vector ,而不是将每个帧写入磁盘并将文件列表发送到 Caffe 的幼稚方法。
现在,我注意到对于相同的图像我不会得到相同的结果!使用 ImageData 层时,没有这样的东西。
我使用 CPU(没有 Cudnn,没有 GPU)。
我用于特征提取的函数如下:
void feature_extraction_pipeline_memory(boost::shared_ptr<Net<Dtype>> feature_extraction_net, vector<cv::Mat> imgs, vector<int> labels, float** blobFeats, vector<string> blob_names){
boost::dynamic_pointer_cast<caffe::MemoryDataLayer<float>>(feature_extraction_net->layers()[0])->AddMatVector(imgs, labels);
size_t num_mini_batches = imgs.size();
size_t num_features = blob_names.size();
int dim_features;
int batch_size;
vector<Blob<float>*> input_vec;
vector<int> image_indices(num_features, 0);
for (size_t batch_index = 0; batch_index < num_mini_batches; ++batch_index) {
feature_extraction_net->Forward(input_vec);
for (size_t i = 0; i < num_features; ++i) {
const boost::shared_ptr<Blob<Dtype>> feature_blob = feature_extraction_net->blob_by_name(blob_names[i]);
batch_size = feature_blob->num();
dim_features = feature_blob->count() / batch_size;
const Dtype* feature_blob_data;
for (size_t n = 0; n < batch_size; ++n) {
feature_blob_data = feature_blob->cpu_data() + feature_blob->offset(n);
for (size_t d = 0; d < dim_features; ++d)
blobFeats[i][(image_indices[i] * dim_features) + d] = feature_blob_data[d];
++image_indices[i];
} // n < batch_size
} // i < num_features
} // batch_index < num_mini_batches
}
imgs
vector 是 mat 的 vector 。 labels
是一个 int vector ,全部设置为 0。一旦将它们添加到 vector 中,我将所有图像再次写入磁盘。我检查了一下,没有问题。所以加载图像时没有错。顺便说一句,我使用 OpenCV 3.1。
GoogLeNet prototxt文件中的内存层声明如下:
layer {
name: "data"
type: "MemoryData"
top: "data"
top: "label"
memory_data_param {
batch_size: 1
channels: 3
height: 227
width: 227
}
transform_param {
crop_size: 227
mirror: true
mean_file: "model_googlenet_mem/imagenet_mean.binaryproto"
}
include: { phase: TEST }
}
并且是第一层。
我为每个图像打印前 10 个值。请注意,图像 0、1、2、3 是复制的完全相同的文件,同样适用于 6、7 和 8 图像。
1st run:
0.jpg :: 3.149, 0.000, 0.000, 0.000, 1.586, 0.000, 0.000, 0.755, 0.000, 4.749,
1.jpg :: 2.680, 0.000, 0.000, 0.560, 0.970, 0.000, 0.000, 1.083, 0.000, 4.420,
2.jpg :: 2.680, 0.000, 0.000, 0.560, 0.970, 0.000, 0.000, 1.083, 0.000, 4.420,
3.jpg :: 2.680, 0.000, 0.000, 0.560, 0.970, 0.000, 0.000, 1.083, 0.000, 4.420,
4.jpg :: 3.957, 0.000, 0.000, 0.000, 0.868, 0.000, 0.000, 0.000, 0.000, 6.396,
5.jpg :: 3.179, 0.000, 0.000, 0.000, 0.906, 0.000, 0.000, 0.000, 0.000, 5.508,
6.jpg :: 4.951, 0.000, 0.000, 0.000, 0.000, 0.343, 2.993, 0.000, 0.000, 0.000,
7.jpg :: 4.567, 0.000, 0.000, 0.000, 0.000, 1.251, 2.446, 0.000, 0.000, 0.000,
8.jpg :: 4.951, 0.000, 0.000, 0.000, 0.000, 0.343, 2.993, 0.000, 0.000, 0.000,
9.jpg :: 5.678, 0.000, 0.000, 2.010, 0.000, 1.064, 2.412, 0.000, 0.000, 0.000,
第二次运行:
0.jpg :: 2.680, 0.000, 0.000, 0.560, 0.970, 0.000, 0.000, 1.083, 0.000, 4.420,
1.jpg :: 2.680, 0.000, 0.000, 0.560, 0.970, 0.000, 0.000, 1.083, 0.000, 4.420,
2.jpg :: 3.149, 0.000, 0.000, 0.000, 1.586, 0.000, 0.000, 0.755, 0.000, 4.749,
3.jpg :: 2.680, 0.000, 0.000, 0.560, 0.970, 0.000, 0.000, 1.083, 0.000, 4.420,
4.jpg :: 3.957, 0.000, 0.000, 0.000, 0.868, 0.000, 0.000, 0.000, 0.000, 6.396,
5.jpg :: 2.928, 0.000, 0.000, 0.000, 0.769, 0.000, 0.000, 0.000, 0.000, 5.552,
6.jpg :: 4.567, 0.000, 0.000, 0.000, 0.000, 1.251, 2.446, 0.000, 0.000, 0.000,
7.jpg :: 4.567, 0.000, 0.000, 0.000, 0.000, 1.251, 2.446, 0.000, 0.000, 0.000,
8.jpg :: 4.951, 0.000, 0.000, 0.000, 0.000, 0.343, 2.993, 0.000, 0.000, 0.000,
9.jpg :: 5.678, 0.000, 0.000, 2.010, 0.000, 1.064, 2.412, 0.000, 0.000, 0.000,
相同图像和不同运行的图层输出不同!当对 ImageData 层使用相同的过程时,就没有这样的问题。此外,该问题也适用于其他层的输出,例如 loss3/classifier。因此,我怀疑 MemoryLayer 实现中可能存在错误。
有没有人注意到这种奇怪的行为?我读到 cudnn 可能会产生不确定的结果,但我在 CPU 上运行了我的模型。欢迎对此有任何想法。
最佳答案
我发现出了什么问题,我会在这里发布答案以帮助其他人。
事实证明,GoogLeNet 要求输入图像的大小为 224x224x3,并且您不能在 TEST 阶段减去均值。因此,通过将 .prototxt 文件中的内存层定义更改为:
name: "GoogleNet"
layer {
name: "data"
type: "MemoryData"
top: "data"
top: "label"
memory_data_param {
batch_size: 1
channels: 3
height: 224
width: 224
}
}
...
我得到了预期的结果。非常感谢@Miki 指出关于他们的 dnn 模块的 OpenCV 教程,这帮助我澄清了这一点。
关于c++ - 使用 Caffe 内存层不会产生一致且确定的结果,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/35481805/
我正在使用 Selenium Web 驱动程序 3.0,并且想要从打开的两个对话框(一个在后台,第二个在前台)的 Activity 对话框中单击“确定”按钮。如何从 html 下面的父 div 单击前
actions: [ FlatButton( onPressed: () {
我有一个问题有点超出我的范围(我真的很高兴我是 Beta)涉及重复项(所以 GROUP BY, HAVING, COUNT),通过将解决方案保留在 SQLite 附带的标准函数中而变得更加复杂。我正在
使用DBI是否可以确定SELECT语句的已执行语句句柄是否返回任何行而不从中获取行? IE。就像是: use DBI; ... my $sth = $dbh->prepare("SELECT ..."
是否可以为“确定”和“关闭”按钮指定回调函数? 如果是JQuery Modal,则可以在初始化时使用按钮字典指定回调函数。 Semantic-ui模态是否提供类似的功能?按下确定后,我该如何寻求其他逻
我想阅读警报中的消息。 示例:如果警报显示“错误的电子邮件地址”。怎么读呢?意味着我想将该消息存储在字符串中。 如何在“警报”中单击“确定”...?? 如何使用 Selenium 来做到这一点? 最佳
我有一个删除按钮: 我试图首先查明是否已选择一个网站,如果已选择一个网站,我需要确定是否已选择一个或多个列表项,如果是,则继续删除这些项目。 我的 if 语句不断返回“您必须首先选择您的列表”,即使它
部分出于好奇——我们想知道在我们的应用程序中发生了什么——部分是因为我们需要在我们的代码中找到一些潜在的问题,我喜欢在我们的网络应用程序运行时跟踪一些一般值。这尤其包括某些对象图的分配内存。 我们的应
我将 SweetAlert 与 Symfony 结合使用,我希望用户在完成删除操作之前进行确认。 发生的情况是,当用户单击删除按钮时,SweetAlert 会弹出,然后立即消失,并且该项目被删除。 在
我们有一个应用程序可以生成不包括字母 O 的随机基数 35 [0-9A-Z]。我正在寻找一种解决方案来查找包含任何淫秽英语单词的代码,而无需搜索包含 10,000 个条目的列表每个生成的代码。每秒生成
这是我做的: #include #include int betweenArray(int a, int b){ int *arr,i,range; range = b - a +
我知道如何创建 警报和确认框,但我不知道如何做的是实际单击“确定”。我有一个弹出确认框的页面。 我想使用 Java Script 插件单击“确定”。基本上,我希望我的代码单击页面上的链接,然后在出现提
代码: swal('Your ORDER has been placed Successfully!!!'); window.location="index.php"; 甜蜜警报工
>>> import re >>> s = "These are the words in a sentence" >>> regex = re.compile('are|words') >>> [m
使用确定的理想散列函数给出随机期望线性时间算法两个数组 A[1..n] 和 B[1..n] 是否不相交,即 A 的元素是否也是 B 的元素。 谁能告诉我如何做到这一点,甚至如何开始考虑它? 最佳答案
我在计算机科学课上有这段代码: int input=15; while (input < n ) { input = input *3;} 这段代码有 log3(n/15) 次循环的上限。我们怎样才能
我有一个允许 2 位玩家玩 TicTacToe 的程序。在每个玩家移动之后,它应该在那个点显示棋盘并返回一个名为 Status 的枚举,显示玩家是否应该继续,如果玩家赢了,还是平局。但是,该算法要么返
给定一个 y 值数组,例如 [-3400, -1000, 500, 1200, 3790],我如何确定“好的”Y 轴标签并将它们放置在网格上? ^ ---(6,000)-|---
假设我有一个检查用户登录的 SQL 语句: SELECT * FROM users WHERE username='test@example.com', password='abc123', expi
teradata中有返回表中哪一列被定义为主索引的命令吗?我没有制作一些我正在处理的表,也没有尝试优化我对这些表的连接。谢谢! 最佳答案 有dbc.IndicesV,其中IndexNumber=1表示
我是一名优秀的程序员,十分优秀!