python - 使用 keras 对图像进行 convnet 回归 - 精度不能提高超过 40%

转载作者：行者123 更新时间：2023-11-28 17:57:26

24

4

要解决的整个问题是读取这些能量计显示的数字。 An Image of the energy meter.然后我需要能够在 android 应用程序中实现所有这些。我要做的是首先通过回归找到包含数字的黑色矩形的位置。然后尝试通过另一个网络读取数字。

1- 我是否选择了解决这个问题的正确途径？

2- 我下面的网络出了什么问题？

我有一个包含 78 张图像的小型数据集，如上图所示。为了预测矩形的位置，我使用 500*200 大小的滑动窗口从原始图像中裁剪了一些小图像。我有将近 10,000 张大小为 500*200 的图像。使用网络的第一个版本，我获得了高精度和低损失。但问题是我对任何输入都得到了相同的考试输出。我尝试了不同的东西并接受了再培训，但没有运气。但是最后一个网络没有准确性。

这就是我加载数据的方式:

def load_train_data(self):
       data = np.empty((0, 20, 50, 1), int)
       labels = np.empty((0, 8), int)
       files = glob.glob(self.dataset_path + '\\train\\*.jpg')
       print('{} train files found'.format(len(files)))
       print('loading files...')
       for i in range(len(files)):
           image = Image.open(files[i]).convert('L')
           data = np.append(data, [np.array(image).reshape((20, 50, 1)).astype('float32') / 255], axis=0)
           labels = np.append(labels, [np.array(self.decode_file_name(files[i]))], axis=0)
       return (data, labels)

def decode_file_name(self, file_name):
       arr = file_name.split('\\')
       name = arr[len(arr) - 1];
       name_parts = name[0:len(name) - 4].split("_")
       if len(name_parts) == 11:
           temp = [int(name_parts[3]), int(name_parts[4]), int(name_parts[5]), int(name_parts[6]),
                int(name_parts[7]), int(name_parts[8]), int(name_parts[9]), int(name_parts[10])]
       else:
           temp = [0, 0, 0, 0, 0, 0, 0, 0]

       return temp

这是模型:

def build_model():
     m = tf.keras.Sequential([
        tf.keras.layers.Conv2D(64, kernel_size=10, activation=tf.keras.activations.relu, input_shape=(20, 50, 1),
                           data_format='channels_last'),
        tf.keras.layers.Conv2D(32, kernel_size=5, activation=tf.keras.activations.relu),
        tf.keras.layers.Flatten(),
        tf.keras.layers.Dense(100, activation=tf.keras.activations.relu),
        # tf.keras.layers.Dropout(0.2),
        tf.keras.layers.Dense(8, activation=tf.keras.activations.linear)
     ])

     m.compile(optimizer=tf.keras.optimizers.Adam(lr=0.0001), loss=tf.keras.losses.mean_absolute_percentage_error,
          metrics=['accuracy'])
     return m

最后是拟合函数:

model = build_model()
history = model.fit(x_train, y_train, epochs=10, validation_data=(x_test, y_test))

这是上述网络的结果:

Accuracy

Loss

更新

我在加载数据集的过程中发现了一个错误并修复了它。我重新训练了网络，但无论我如何更改网络，准确率都低于 40%。

最佳答案

下面是使用OpenCV获取黑色矩形ROI的方法

将图像转换为灰度和高斯模糊
Canny 边缘检测
执行形态学操作以平滑图像
使用最小阈值区域查找轮廓并进行过滤
用所需的矩形创建 mask
提取投资返回率

Canny边缘检测

变形关闭

找到轮廓并使用最小阈值区域进行过滤以隔离矩形，然后绘制到蒙版上

从这里，我们找到边界矩形，然后使用 Numpy 切片提取

结果

import cv2
import numpy as np

image = cv2.imread('1.jpg')
result = image.copy()
mask = np.zeros(result.shape, dtype=np.uint8)
blur = cv2.GaussianBlur(image, (3,3), 0)
gray = cv2.cvtColor(blur, cv2.COLOR_BGR2GRAY)
canny = cv2.Canny(gray, 120, 255, 1)
kernel = cv2.getStructuringElement(cv2.MORPH_RECT, (3,3))
close = cv2.morphologyEx(canny, cv2.MORPH_CLOSE, kernel)

cnts = cv2.findContours(close, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
cnts = cnts[0] if len(cnts) == 2 else cnts[1]

min_area = 10000
for c in cnts:
    area = cv2.contourArea(c)
    if area > min_area:
        cv2.drawContours(mask, [c], -1, (255,255,255), -1)

mask = cv2.cvtColor(mask, cv2.COLOR_BGR2GRAY)
result[mask==0] = (255,255,255)

mask_canny = cv2.Canny(result, 120, 255, 1)
cnts = cv2.findContours(mask_canny, cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)
cnts = cnts[0] if len(cnts) == 2 else cnts[1]

for c in cnts:
    x,y,w,h = cv2.boundingRect(c)
    ROI = result[y:y+h, x:x+w]
    cv2.imwrite("ROI.png", ROI)
    cv2.rectangle(result, (x, y), (x + w, y + h), (36,255,12), 2)

cv2.imshow('canny', canny)
cv2.imshow('close', close)
cv2.imshow('image', image)
cv2.imshow('mask', mask)
cv2.imshow('result', result)
cv2.waitKey(0)

关于python - 使用 keras 对图像进行 convnet 回归 - 精度不能提高超过 40%，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/57483565/

24

4

0

文章推荐： ios - Double\\in 正则表达式 iOS

文章推荐： CSS3 动画延迟时间

文章推荐： javascript - 如何向 JavaScript 对象添加匿名属性？

文章推荐： jquery - 需要一些帮助，关于 float 菜单中的事件状态

keras - keras 和 tf.keras 模型之间的兼容性
我有兴趣在 tf.keras 中训练一个模型，然后用 keras 加载它。我知道这不是高度建议，但我对使用 tf.keras 来训练模型很感兴趣，因为 tf.keras 更容易构建输入管道我想利用
keras - Keras 中的自定义损失函数结合了多个输出
我进行了大量搜索，但仍然无法弄清楚如何编写具有多个交互输出的自定义损失函数。我有一个神经网络定义为: def NeuralNetwork(): inLayer = Input((2,));
keras - 差异学习率 - Keras
我正在阅读一篇名为 Differential Learning Rates 的文章在 Medium 上，想知道这是否可以应用于 Keras。我能够找到在 pytorch 中实现的这项技术。这可以在 K
keras - Keras 如何评估测试集上的损失？
我正在实现一个神经网络分类器，以打印我正在使用的这个神经网络的损失和准确性: score = model.evaluate(x_test, y_test, verbose=False) model.m
keras - keras 模型输出形状中的方括号
我最近在查看模型摘要时遇到了这个问题。我想知道，[(None, 16)] 和有什么区别？和 (None, 16) ?为什么输入层有这样的输入形状？来源:model.summary() can't
keras - Keras 中基于输入数据的自定义损失函数
我正在尝试使用 Keras 创建自定义损失函数。我想根据输入计算损失函数并预测神经网络的输出。我尝试在 Keras 中使用 customloss 函数。我认为 y_true 是我们为训练提供的输出，
keras - keras 中二维元素的填充序列
我有一组样本，每个样本都是一组属性的序列(例如，一个样本可以包含 10 个序列，每个序列具有 5 个属性)。属性的数量总是固定的，但序列的数量(时间戳)可能因样本而异。我想使用这个样本集在 Keras
keras - Keras 中的类数量错误
Keras 在训练集和测试集文件夹中发现了错误数量的类。我有 3 节课，但它一直说有 4 节课。有人可以帮我吗？这里的代码: cnn = Sequential() cnn.add(Conv2D(32
keras - keras 自定义层中的持久变量
我想编写一个自定义层，在其中我可以在两次运行之间将变量保存在内存中。例如， class MyLayer(Layer): def __init__(self, out_dim = 51, **kwarg
keras - Keras:如何将学习率输出到张量板上
我添加了一个回调来降低学习速度： keras.callbacks.ReduceLROnPlateau(monitor='val_loss', factor=0.5, patience=100,
keras - keras lstm层中的多个内核是什么意思？
在 https://keras.io/layers/recurrent/我看到 LSTM 层有一个 kernel和一个 recurrent_kernel .它们的含义是什么？根据我的理解，我们需要 L
keras - 如何检查安装了哪个版本的 Keras？
问题与标题相同。我不想打开 Python，而是使用 MacOS 或 Ubuntu。最佳答案 Python 库作者将版本号放入 .__version__ 。您可以通过在命令行上运行以下命令来打印它:
keras - Keras 中的嵌入是什么？
Keras 文档并不清楚这实际上是什么。我知道我们可以用它来将输入特征空间压缩成更小的空间。但从神经设计的角度来看，这是如何完成的呢？它是一个自动编码器，RBM吗？最佳答案据我所知，嵌入层是一个简
keras - Keras 的中心损失
我想实现[http://ydwen.github.io/papers/WenECCV16.pdf]中解释的中心损失]在喀拉斯我开始创建一个具有 2 个输出的网络，例如: inputs = Input
keras - keras 中的多对一实现
我正在尝试实现多对一模型，其中输入是大小为的词向量d .我需要输出一个大小为的向量d 在 LSTM 结束时。在此 question ，提到使用(对于多对一模型) model = Sequenti
keras - Keras 中验证集的不同损失函数
我有不平衡的训练数据集，这就是我构建自定义加权分类交叉熵损失函数的原因。但问题是我的验证集是平衡的，我想使用常规的分类交叉熵损失。那么我可以在 Keras 中为验证集传递不同的损失函数吗？我的意思是用
keras - Keras 中输入数据的规范化
DL 中的一项常见任务是将输入样本归一化为零均值和单位方差。可以使用如下代码“手动”执行规范化: mean = np.mean(X, axis = 0) std = np.std(X, axis =
keras - Keras 中回调和进度条的准确性不匹配
我正在尝试学习 Keras 并使用 LSTM 解决分类问题。我希望能够绘制准确率和损失，并在训练期间更新图。为此，我正在使用 callback function . 由于某种原因，我在回调中收到的准
keras - 嵌入 Keras
在 Keras 内置函数中嵌入使用哪种算法？Word2vec？手套？其他？ https://keras.io/layers/embeddings/ 最佳答案简短的回答是都不是。本质上，GloVe 的
keras - keras 中的渐变裁剪
我有一个使用 Keras 完全实现的 LSTM RNN，我想使用梯度剪裁，梯度范数限制为 5(我正在尝试复制一篇研究论文)。在实现神经网络方面，我是一个初学者，我将如何实现？是否只是(我正在使用 r

首页

博学

6Ren·AI

商城

python - 使用 keras 对图像进行 convnet 回归 - 精度不能提高超过 40%

更新