- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
要解决的整个问题是读取这些能量计显示的数字。 An Image of the energy meter.然后我需要能够在 android 应用程序中实现所有这些。我要做的是首先通过回归找到包含数字的黑色矩形的位置。然后尝试通过另一个网络读取数字。
1- 我是否选择了解决这个问题的正确途径?
2- 我下面的网络出了什么问题?
我有一个包含 78 张图像的小型数据集,如上图所示。为了预测矩形的位置,我使用 500*200 大小的滑动窗口从原始图像中裁剪了一些小图像。我有将近 10,000 张大小为 500*200 的图像。使用网络的第一个版本,我获得了高精度和低损失。但问题是我对任何输入都得到了相同的考试输出。我尝试了不同的东西并接受了再培训,但没有运气。但是最后一个网络没有准确性。
这就是我加载数据的方式:
def load_train_data(self):
data = np.empty((0, 20, 50, 1), int)
labels = np.empty((0, 8), int)
files = glob.glob(self.dataset_path + '\\train\\*.jpg')
print('{} train files found'.format(len(files)))
print('loading files...')
for i in range(len(files)):
image = Image.open(files[i]).convert('L')
data = np.append(data, [np.array(image).reshape((20, 50, 1)).astype('float32') / 255], axis=0)
labels = np.append(labels, [np.array(self.decode_file_name(files[i]))], axis=0)
return (data, labels)
def decode_file_name(self, file_name):
arr = file_name.split('\\')
name = arr[len(arr) - 1];
name_parts = name[0:len(name) - 4].split("_")
if len(name_parts) == 11:
temp = [int(name_parts[3]), int(name_parts[4]), int(name_parts[5]), int(name_parts[6]),
int(name_parts[7]), int(name_parts[8]), int(name_parts[9]), int(name_parts[10])]
else:
temp = [0, 0, 0, 0, 0, 0, 0, 0]
return temp
这是模型:
def build_model():
m = tf.keras.Sequential([
tf.keras.layers.Conv2D(64, kernel_size=10, activation=tf.keras.activations.relu, input_shape=(20, 50, 1),
data_format='channels_last'),
tf.keras.layers.Conv2D(32, kernel_size=5, activation=tf.keras.activations.relu),
tf.keras.layers.Flatten(),
tf.keras.layers.Dense(100, activation=tf.keras.activations.relu),
# tf.keras.layers.Dropout(0.2),
tf.keras.layers.Dense(8, activation=tf.keras.activations.linear)
])
m.compile(optimizer=tf.keras.optimizers.Adam(lr=0.0001), loss=tf.keras.losses.mean_absolute_percentage_error,
metrics=['accuracy'])
return m
最后是拟合函数:
model = build_model()
history = model.fit(x_train, y_train, epochs=10, validation_data=(x_test, y_test))
这是上述网络的结果:
我在加载数据集的过程中发现了一个错误并修复了它。我重新训练了网络,但无论我如何更改网络,准确率都低于 40%。
最佳答案
下面是使用OpenCV获取黑色矩形ROI的方法
Canny边缘检测
变形关闭
找到轮廓并使用最小阈值区域进行过滤以隔离矩形,然后绘制到蒙版上
从这里,我们找到边界矩形,然后使用 Numpy 切片提取
结果
import cv2
import numpy as np
image = cv2.imread('1.jpg')
result = image.copy()
mask = np.zeros(result.shape, dtype=np.uint8)
blur = cv2.GaussianBlur(image, (3,3), 0)
gray = cv2.cvtColor(blur, cv2.COLOR_BGR2GRAY)
canny = cv2.Canny(gray, 120, 255, 1)
kernel = cv2.getStructuringElement(cv2.MORPH_RECT, (3,3))
close = cv2.morphologyEx(canny, cv2.MORPH_CLOSE, kernel)
cnts = cv2.findContours(close, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
cnts = cnts[0] if len(cnts) == 2 else cnts[1]
min_area = 10000
for c in cnts:
area = cv2.contourArea(c)
if area > min_area:
cv2.drawContours(mask, [c], -1, (255,255,255), -1)
mask = cv2.cvtColor(mask, cv2.COLOR_BGR2GRAY)
result[mask==0] = (255,255,255)
mask_canny = cv2.Canny(result, 120, 255, 1)
cnts = cv2.findContours(mask_canny, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
cnts = cnts[0] if len(cnts) == 2 else cnts[1]
for c in cnts:
x,y,w,h = cv2.boundingRect(c)
ROI = result[y:y+h, x:x+w]
cv2.imwrite("ROI.png", ROI)
cv2.rectangle(result, (x, y), (x + w, y + h), (36,255,12), 2)
cv2.imshow('canny', canny)
cv2.imshow('close', close)
cv2.imshow('image', image)
cv2.imshow('mask', mask)
cv2.imshow('result', result)
cv2.waitKey(0)
关于python - 使用 keras 对图像进行 convnet 回归 - 精度不能提高超过 40%,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/57483565/
我有兴趣在 tf.keras 中训练一个模型,然后用 keras 加载它。我知道这不是高度建议,但我对使用 tf.keras 来训练模型很感兴趣,因为 tf.keras 更容易构建输入管道 我想利用
我进行了大量搜索,但仍然无法弄清楚如何编写具有多个交互输出的自定义损失函数。 我有一个神经网络定义为: def NeuralNetwork(): inLayer = Input((2,));
我正在阅读一篇名为 Differential Learning Rates 的文章在 Medium 上,想知道这是否可以应用于 Keras。我能够找到在 pytorch 中实现的这项技术。这可以在 K
我正在实现一个神经网络分类器,以打印我正在使用的这个神经网络的损失和准确性: score = model.evaluate(x_test, y_test, verbose=False) model.m
我最近在查看模型摘要时遇到了这个问题。 我想知道,[(None, 16)] 和有什么区别?和 (None, 16) ?为什么输入层有这样的输入形状? 来源:model.summary() can't
我正在尝试使用 Keras 创建自定义损失函数。我想根据输入计算损失函数并预测神经网络的输出。 我尝试在 Keras 中使用 customloss 函数。我认为 y_true 是我们为训练提供的输出,
我有一组样本,每个样本都是一组属性的序列(例如,一个样本可以包含 10 个序列,每个序列具有 5 个属性)。属性的数量总是固定的,但序列的数量(时间戳)可能因样本而异。我想使用这个样本集在 Keras
Keras 在训练集和测试集文件夹中发现了错误数量的类。我有 3 节课,但它一直说有 4 节课。有人可以帮我吗? 这里的代码: cnn = Sequential() cnn.add(Conv2D(32
我想编写一个自定义层,在其中我可以在两次运行之间将变量保存在内存中。例如, class MyLayer(Layer): def __init__(self, out_dim = 51, **kwarg
我添加了一个回调来降低学习速度: keras.callbacks.ReduceLROnPlateau(monitor='val_loss', factor=0.5, patience=100,
在 https://keras.io/layers/recurrent/我看到 LSTM 层有一个 kernel和一个 recurrent_kernel .它们的含义是什么?根据我的理解,我们需要 L
问题与标题相同。 我不想打开 Python,而是使用 MacOS 或 Ubuntu。 最佳答案 Python 库作者将版本号放入 .__version__ 。您可以通过在命令行上运行以下命令来打印它:
Keras 文档并不清楚这实际上是什么。我知道我们可以用它来将输入特征空间压缩成更小的空间。但从神经设计的角度来看,这是如何完成的呢?它是一个自动编码器,RBM吗? 最佳答案 据我所知,嵌入层是一个简
我想实现[http://ydwen.github.io/papers/WenECCV16.pdf]中解释的中心损失]在喀拉斯 我开始创建一个具有 2 个输出的网络,例如: inputs = Input
我正在尝试实现多对一模型,其中输入是大小为 的词向量d .我需要输出一个大小为 的向量d 在 LSTM 结束时。 在此 question ,提到使用(对于多对一模型) model = Sequenti
我有不平衡的训练数据集,这就是我构建自定义加权分类交叉熵损失函数的原因。但问题是我的验证集是平衡的,我想使用常规的分类交叉熵损失。那么我可以在 Keras 中为验证集传递不同的损失函数吗?我的意思是用
DL 中的一项常见任务是将输入样本归一化为零均值和单位方差。可以使用如下代码“手动”执行规范化: mean = np.mean(X, axis = 0) std = np.std(X, axis =
我正在尝试学习 Keras 并使用 LSTM 解决分类问题。我希望能够绘制 准确率和损失,并在训练期间更新图。为此,我正在使用 callback function . 由于某种原因,我在回调中收到的准
在 Keras 内置函数中嵌入使用哪种算法?Word2vec?手套?其他? https://keras.io/layers/embeddings/ 最佳答案 简短的回答是都不是。本质上,GloVe 的
我有一个使用 Keras 完全实现的 LSTM RNN,我想使用梯度剪裁,梯度范数限制为 5(我正在尝试复制一篇研究论文)。在实现神经网络方面,我是一个初学者,我将如何实现? 是否只是(我正在使用 r
我是一名优秀的程序员,十分优秀!