Keras: model实现固定部分layer,训练部分layer操作-6ren

Keras: model实现固定部分layer,训练部分layer操作

转载作者：qq735679552 更新时间：2022-09-29 22:32:09

25

4

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章Keras: model实现固定部分layer,训练部分layer操作由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

需求：Resnet50做调优训练，将最后分类数目由1000改为500.

问题：网上下载了resnet50_weights_tf_dim_ordering_tf_kernels_notop.h5，更改了Resnet50后，由于所有层均参加训练，导致训练速度慢。实际上只需要训练最后3层，前面的层都不需要训练.

解决办法:

①将模型拆分为两个模型，一个为前面的notop部分，一个为最后三层，然后利用model的trainable属性设置只有后一个model训练，最后将两个模型合并起来.

②不用拆分，遍历模型的所有层，将前面层的trainable设置为False即可。代码如下:

 
    ? 
   
         for 
         layer  
         in 
         model.layers[: 
         - 
         3 
         ]: 
        
         print 
         (layer.trainable) 
        
         layer.trainable  
         = 
         False

注意事项:

①尽量不要这样:

layers.Conv2D(filters1, (1, 1), trainable=False)(input_tensor) 。

因为容易出错。。.

②加载notop参数时注意by_name=True. 。

补充知识：Keras关于训练冻结部分层。

设置冻结层有两种方式.

（不推荐）是在搭建网络时，直接将某层的trainable设置为false，例如

layers.Conv2D(filters1, (1, 1), trainable=False)(input_tensor) 。

在网络搭建完成时，遍历model.layer,然后将layer.trainable设置为False

 
    ? 
   
         # 冻结网络倒数的3层 
        
         for 
         layer  
         in 
         model.layers[: 
         - 
         3 
         ]: 
        
         print 
         (layer.trainable) 
        
         layer.trainable  
         = 
         False

也可以根据layer.name来确定哪些层需要冻结,例如冻结最后一层和RNN层:

 
    ? 
   
         for 
         layer  
         in 
         model.layers: 
        
         layerName 
         = 
         str 
         (layer.name) 
        
         if 
         layerName.startswith( 
         "RNN_" 
         )  
         or 
         layerName.startswith( 
         "Final_" 
         ): 
        
         layer.trainable 
         = 
         False

可以在实例化之后将网络层的 trainable 属性设置为 True 或 False。为了使之生效，在修改 trainable 属性之后，需要在模型上调用 compile().

这是一个例子。

 
    ? 
   
         x  
         = 
         Input 
         (shape 
         = 
         ( 
         32 
         ,)) 
        
         layer  
         = 
         Dense( 
         32 
         ) 
        
         layer.trainable  
         = 
         False 
        
         y  
         = 
         layer(x) 
        
         frozen_model  
         = 
         Model(x, y) 
        
         # 在下面的模型中，训练期间不会更新层的权重 
        
         frozen_model. 
         compile 
         (optimizer 
         = 
         'rmsprop' 
         , loss 
         = 
         'mse' 
         ) 
        
         layer.trainable  
         = 
         True 
        
         trainable_model  
         = 
         Model(x, y) 
        
         # 使用这个模型，训练期间 `layer` 的权重将被更新 
        
         # (这也会影响上面的模型，因为它使用了同一个网络层实例) 
        
         trainable_model. 
         compile 
         (optimizer 
         = 
         'rmsprop' 
         , loss 
         = 
         'mse' 
         ) 
        
         frozen_model.fit(data, labels)  
         # 这不会更新 `layer` 的权重 
        
         trainable_model.fit(data, labels)  
         # 这会更新 `layer` 的权重

在网络搭建时，可以考虑最后一个分类层命名和分类数量关联，这样当费雷数量方式变化时，model.load_weight(“weight.h5”，by_name=True)不会加载最后一层。

以上这篇Keras: model实现固定部分layer,训练部分layer操作就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持我.

原文链接：https://blog.csdn.net/SingingFisher/article/details/81093963 。

最后此篇关于Keras: model实现固定部分layer,训练部分layer操作的文章就讲到这里了,如果你想了解更多关于Keras: model实现固定部分layer,训练部分layer操作的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

25

4

0

文章推荐：解决Keras TensorFlow 混编中 trainable=False设置无效问题

文章推荐： php导出中文内容excel文件类实例

文章推荐： PHP伪造来源HTTP_REFERER的方法实例详解

文章推荐： sklearn的predict_proba使用说明

keras - keras 和 tf.keras 模型之间的兼容性
我有兴趣在 tf.keras 中训练一个模型，然后用 keras 加载它。我知道这不是高度建议，但我对使用 tf.keras 来训练模型很感兴趣，因为 tf.keras 更容易构建输入管道我想利用
keras - Keras 中的自定义损失函数结合了多个输出
我进行了大量搜索，但仍然无法弄清楚如何编写具有多个交互输出的自定义损失函数。我有一个神经网络定义为: def NeuralNetwork(): inLayer = Input((2,));
keras - 差异学习率 - Keras
我正在阅读一篇名为 Differential Learning Rates 的文章在 Medium 上，想知道这是否可以应用于 Keras。我能够找到在 pytorch 中实现的这项技术。这可以在 K
keras - Keras 如何评估测试集上的损失？
我正在实现一个神经网络分类器，以打印我正在使用的这个神经网络的损失和准确性: score = model.evaluate(x_test, y_test, verbose=False) model.m
keras - keras 模型输出形状中的方括号
我最近在查看模型摘要时遇到了这个问题。我想知道，[(None, 16)] 和有什么区别？和 (None, 16) ?为什么输入层有这样的输入形状？来源:model.summary() can't
keras - Keras 中基于输入数据的自定义损失函数
我正在尝试使用 Keras 创建自定义损失函数。我想根据输入计算损失函数并预测神经网络的输出。我尝试在 Keras 中使用 customloss 函数。我认为 y_true 是我们为训练提供的输出，
keras - keras 中二维元素的填充序列
我有一组样本，每个样本都是一组属性的序列(例如，一个样本可以包含 10 个序列，每个序列具有 5 个属性)。属性的数量总是固定的，但序列的数量(时间戳)可能因样本而异。我想使用这个样本集在 Keras
keras - Keras 中的类数量错误
Keras 在训练集和测试集文件夹中发现了错误数量的类。我有 3 节课，但它一直说有 4 节课。有人可以帮我吗？这里的代码: cnn = Sequential() cnn.add(Conv2D(32
keras - keras 自定义层中的持久变量
我想编写一个自定义层，在其中我可以在两次运行之间将变量保存在内存中。例如， class MyLayer(Layer): def __init__(self, out_dim = 51, **kwarg
keras - Keras:如何将学习率输出到张量板上
我添加了一个回调来降低学习速度： keras.callbacks.ReduceLROnPlateau(monitor='val_loss', factor=0.5, patience=100,
keras - keras lstm层中的多个内核是什么意思？
在 https://keras.io/layers/recurrent/我看到 LSTM 层有一个 kernel和一个 recurrent_kernel .它们的含义是什么？根据我的理解，我们需要 L
keras - 如何检查安装了哪个版本的 Keras？
问题与标题相同。我不想打开 Python，而是使用 MacOS 或 Ubuntu。最佳答案 Python 库作者将版本号放入 .__version__ 。您可以通过在命令行上运行以下命令来打印它:
keras - Keras 中的嵌入是什么？
Keras 文档并不清楚这实际上是什么。我知道我们可以用它来将输入特征空间压缩成更小的空间。但从神经设计的角度来看，这是如何完成的呢？它是一个自动编码器，RBM吗？最佳答案据我所知，嵌入层是一个简
keras - Keras 的中心损失
我想实现[http://ydwen.github.io/papers/WenECCV16.pdf]中解释的中心损失]在喀拉斯我开始创建一个具有 2 个输出的网络，例如: inputs = Input
keras - keras 中的多对一实现
我正在尝试实现多对一模型，其中输入是大小为的词向量d .我需要输出一个大小为的向量d 在 LSTM 结束时。在此 question ，提到使用(对于多对一模型) model = Sequenti
keras - Keras 中验证集的不同损失函数
我有不平衡的训练数据集，这就是我构建自定义加权分类交叉熵损失函数的原因。但问题是我的验证集是平衡的，我想使用常规的分类交叉熵损失。那么我可以在 Keras 中为验证集传递不同的损失函数吗？我的意思是用
keras - Keras 中输入数据的规范化
DL 中的一项常见任务是将输入样本归一化为零均值和单位方差。可以使用如下代码“手动”执行规范化: mean = np.mean(X, axis = 0) std = np.std(X, axis =
keras - Keras 中回调和进度条的准确性不匹配
我正在尝试学习 Keras 并使用 LSTM 解决分类问题。我希望能够绘制准确率和损失，并在训练期间更新图。为此，我正在使用 callback function . 由于某种原因，我在回调中收到的准
keras - 嵌入 Keras
在 Keras 内置函数中嵌入使用哪种算法？Word2vec？手套？其他？ https://keras.io/layers/embeddings/ 最佳答案简短的回答是都不是。本质上，GloVe 的
keras - keras 中的渐变裁剪
我有一个使用 Keras 完全实现的 LSTM RNN，我想使用梯度剪裁，梯度范数限制为 5(我正在尝试复制一篇研究论文)。在实现神经网络方面，我是一个初学者，我将如何实现？是否只是(我正在使用 r

首页

博学

6Ren·AI

商城

Keras: model实现固定部分layer,训练部分layer操作