- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在开始学习深度学习,并且有一个关于 CNN 的基本问题。我了解如何根据损失函数使用反向传播来调整梯度。但我认为卷积滤波器矩阵(CNN 中)的值需要由我们确定。
我正在使用 Keras,这就是(来自教程)卷积层的定义方式:
classifier = Sequential()
classifier.add(Conv2D(32, (3, 3), input_shape = (64, 64, 3), activation = 'relu'))
使用了 32 个尺寸为 3x3 的滤波器矩阵。
但是,这些 32x3x3 矩阵的值是如何确定的?
最佳答案
调整的不是梯度,反向传播算法计算出的梯度只是网络中每个权值的偏导数组,这些分量依次用于调整网络权值,以最小化网络权值损失。
看看这个 introductive guide .
示例中卷积层中的权重将被初始化为随机值(根据特定方法),然后在训练期间进行调整,使用每次迭代时的梯度来调整每个单独的权重。对于全连接层或任何其他具有权重的层中的权重也是如此。
编辑:我正在添加有关上述答案的更多详细信息。
假设您有一个单层神经网络,其中有一些权重 W。现在,在前向传递过程中,您计算网络的输出 yHat,将其与训练样本的预期输出 y 进行比较,然后计算一些成本 C(例如,使用二次成本函数)。
现在,您有兴趣使网络更加准确,即。你想尽可能地减少 C。想象一下,您想要找到 f(x)=x^2 这样的简单函数的最小值。您可以从某个随机点开始(就像您对网络所做的那样),然后计算该点处函数的斜率(即导数)并沿着该方向移动,直到达到最小值(至少是局部最小值) )。
对于神经网络来说,这是同样的想法,不同之处在于你的输入是固定的(训练样本),你可以看到你的成本函数 C 有 n 个变量,其中 n 是网络中权重的数量。为了最小化 C,您需要成本函数 C 在每个方向上的斜率(即相对于每个变量、每个权重 w),并且偏导数的向量就是梯度。
一旦你有了梯度,你“沿着斜率移动一点”的部分就是权重更新部分,你根据它的偏导数更新每个网络权重(一般来说,你减去一些学习率乘以相对于该权重的偏导数)。
经过训练的网络只是一个网络,其权重经过多次迭代调整,使得训练数据集上的成本函数 C 的值尽可能小。
对于卷积层来说也是一样的:首先随机初始化权重(即,将自己放置在成本函数 C 图上的随机位置),然后计算梯度,然后“下坡” , IE。您可以按照梯度调整每个权重,以最小化 C。
全连接层和卷积层之间的唯一区别在于它们如何计算输出,以及如何计算梯度,但是使用梯度更新每个权重的部分对于网络。
因此,为了回答您的问题,卷积核中的那些滤波器最初是随机的,然后使用反向传播算法进行调整,如上所述。
希望这有帮助!
关于deep-learning - 确定 CNN 中滤波器矩阵的值,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/48143222/
我正在使用 Selenium Web 驱动程序 3.0,并且想要从打开的两个对话框(一个在后台,第二个在前台)的 Activity 对话框中单击“确定”按钮。如何从 html 下面的父 div 单击前
actions: [ FlatButton( onPressed: () {
我有一个问题有点超出我的范围(我真的很高兴我是 Beta)涉及重复项(所以 GROUP BY, HAVING, COUNT),通过将解决方案保留在 SQLite 附带的标准函数中而变得更加复杂。我正在
使用DBI是否可以确定SELECT语句的已执行语句句柄是否返回任何行而不从中获取行? IE。就像是: use DBI; ... my $sth = $dbh->prepare("SELECT ..."
是否可以为“确定”和“关闭”按钮指定回调函数? 如果是JQuery Modal,则可以在初始化时使用按钮字典指定回调函数。 Semantic-ui模态是否提供类似的功能?按下确定后,我该如何寻求其他逻
我想阅读警报中的消息。 示例:如果警报显示“错误的电子邮件地址”。怎么读呢?意味着我想将该消息存储在字符串中。 如何在“警报”中单击“确定”...?? 如何使用 Selenium 来做到这一点? 最佳
我有一个删除按钮: 我试图首先查明是否已选择一个网站,如果已选择一个网站,我需要确定是否已选择一个或多个列表项,如果是,则继续删除这些项目。 我的 if 语句不断返回“您必须首先选择您的列表”,即使它
部分出于好奇——我们想知道在我们的应用程序中发生了什么——部分是因为我们需要在我们的代码中找到一些潜在的问题,我喜欢在我们的网络应用程序运行时跟踪一些一般值。这尤其包括某些对象图的分配内存。 我们的应
我将 SweetAlert 与 Symfony 结合使用,我希望用户在完成删除操作之前进行确认。 发生的情况是,当用户单击删除按钮时,SweetAlert 会弹出,然后立即消失,并且该项目被删除。 在
我们有一个应用程序可以生成不包括字母 O 的随机基数 35 [0-9A-Z]。我正在寻找一种解决方案来查找包含任何淫秽英语单词的代码,而无需搜索包含 10,000 个条目的列表每个生成的代码。每秒生成
这是我做的: #include #include int betweenArray(int a, int b){ int *arr,i,range; range = b - a +
我知道如何创建 警报和确认框,但我不知道如何做的是实际单击“确定”。我有一个弹出确认框的页面。 我想使用 Java Script 插件单击“确定”。基本上,我希望我的代码单击页面上的链接,然后在出现提
代码: swal('Your ORDER has been placed Successfully!!!'); window.location="index.php"; 甜蜜警报工
>>> import re >>> s = "These are the words in a sentence" >>> regex = re.compile('are|words') >>> [m
使用确定的理想散列函数给出随机期望线性时间算法两个数组 A[1..n] 和 B[1..n] 是否不相交,即 A 的元素是否也是 B 的元素。 谁能告诉我如何做到这一点,甚至如何开始考虑它? 最佳答案
我在计算机科学课上有这段代码: int input=15; while (input < n ) { input = input *3;} 这段代码有 log3(n/15) 次循环的上限。我们怎样才能
我有一个允许 2 位玩家玩 TicTacToe 的程序。在每个玩家移动之后,它应该在那个点显示棋盘并返回一个名为 Status 的枚举,显示玩家是否应该继续,如果玩家赢了,还是平局。但是,该算法要么返
给定一个 y 值数组,例如 [-3400, -1000, 500, 1200, 3790],我如何确定“好的”Y 轴标签并将它们放置在网格上? ^ ---(6,000)-|---
假设我有一个检查用户登录的 SQL 语句: SELECT * FROM users WHERE username='test@example.com', password='abc123', expi
teradata中有返回表中哪一列被定义为主索引的命令吗?我没有制作一些我正在处理的表,也没有尝试优化我对这些表的连接。谢谢! 最佳答案 有dbc.IndicesV,其中IndexNumber=1表示
我是一名优秀的程序员,十分优秀!