algorithm - 如何测试我的反向传播神经网络的实现是否正确-6ren

algorithm - 如何测试我的反向传播神经网络的实现是否正确

转载作者：塔克拉玛干更新时间：2023-11-03 03:16:35

27

4

我正在研究反向传播算法的实现。到目前为止我已经实现的似乎有效，但我不能确定该算法是否得到很好的实现，这是我在网络训练测试期间注意到的:

实现规范:

包含近 100000 个原始数据集(3 个变量作为输入，这三个变量之和的正弦曲线作为预期输出)。
网络确实有 7 层，所有层都使用 Sigmoid 激活函数

当我运行反向传播训练过程时:

最小的错误代价是在第四次迭代时找到的(最小的错误代价是140，这正常吗？我期望的比那个少很多)
在第四次迭代后，错误的成本开始增加(我不知道这是否正常？)

最佳答案

简短的回答是“不，很可能您的实现不正确”。您的网络没有经过训练，可以通过非常高的错误成本观察到。正如评论中所讨论的，您的网络受到 vanishing gradient problem 的严重影响。，这在深度网络中是不可避免的。本质上，你网络的第一层比后面的学习得慢得多。所有的神经元一开始都会得到一些随机的权重，对吧？由于第一层几乎没有学到任何东西，因此较大的初始错误会传播到整个网络!

如何解决？从您对问题的描述看来，只有一个隐藏层的前馈网络应该能够解决这个问题(如 universal approximation theorem 中所证明)。

检查例如free online book by Michael Nielsen如果您想了解更多信息。

so I do understand from that the back propagation can't deal with deep neural networks? or is there some method to prevent this problem?

可以，但这绝不是一个微不足道的挑战。深度神经网络从 60 年代就开始使用，但直到 90 年代，研究人员才想出如何有效地处理它们的方法。我推荐阅读“Neural Networks: Tricks of the Trade”的“Efficient BackProp”一章(作者 Y.A. LeCun 等人)。

总结如下:

打乱例子
通过减去平均值使输入变量居中
将输入变量归一化为标准差 1
如果可能，对输入变量去相关。
选择一个具有 sigmoid 函数的网络 f(x)=1.7159*(tanh(2/3x):它不会在 +1/-1 处饱和，而是具有最高增益在这些点(二阶导数最大)
将目标值设置在 sigmoid 范围内，通常为 +1 和 -1。
应从均值为零且标准差由 m^(-1/2) 给出的分布中随机抽取权重，其中 m 是单元的输入

应按如下方式选择训练网络的首选方法:

如果训练集很大(超过几百个样本)且冗余，并且任务是分类，请使用经过仔细调整的随机梯度，或使用随机对角 Levenberg Marquardt 方法。
如果训练集不是太大，或者任务是回归，则使用共轭梯度。

此外，我的一些一般性评论:

如果您自己实现，请注意数值稳定性。很容易陷入麻烦。
想想架构。全连接的多层网络很少是一个聪明的想法。不幸的是，从理论的角度来看，人们对 ANN 了解甚少，您可以做的最好的事情之一就是检查对其他人有效的方法并学习有用的模式(使用正则化、池化和丢弃层等)。

关于algorithm - 如何测试我的反向传播神经网络的实现是否正确，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/41872353/

27

4

0

文章推荐： java - Jackson:Map的反序列化

文章推荐： Java RMI 连接异常 : Connection refused to host/timeout

java - @Transactional(传播=传播。需要)
如果有人能解释这个注释的作用以及我们何时使用它: @Transactional(propagation=Propagation.REQUIRED) 谢谢最佳答案如果您需要在 Spring Docs
Javascript - 阻止模态键盘事件冒泡/传播
我有一个页面，它有一个 keydown 事件监听器，用于监听 Escape 键，以便返回。我还有一个简单的模态类，它也监听 Escape 键以关闭它。主页监听器检查模式是否打开，如果打开，则不执行任何
Modelica 传播/默认变量名
我想在模型中设置默认变量名称 T (=xx) - 将该模型拖到新模型中并在其中定义变量 xx。我收到错误消息:使用未声明的变量 xx。这是子模型 model test parameter Rea
jqueryMobile 水龙头和冒泡/传播
在 android 2.x 浏览器中查看此示例..它是在我的应用程序中复制场景的示例.. http://johnchacko.net/samples/tap.html 它是关于监听“tap”并从监听器
C# 捕获特定异常类型的重新抛出/传播
如您所见，我正在尝试将 GatewayConnectionFailedException 传播到我的 UI。我希望此代码捕获除异常之外的所有内容，我希望表示层捕获该异常以通知用户数据库是问题所在，以便
CMake 静态库依赖项不随 ExternalProject_Add 传播
我目前正在尝试让可执行文件与它需要的所有依赖项正确链接。这是依赖项的示例结构: exe -> libA -> libB exe和 libA有自己的存储库。 exe拉入libA像这样的东西: add_
scala - Scala中的“传播”参数？
有什么方法可以调用带有单个参数的 Scala 函数，给定一个数组 (类似于 JavaScript Spreads在 ECMAScript 6) 中？ ys = [10.0, 2.72, -3.14]
Cmake:包含目录的 target_link_libraries 传播
我有一个小型静态库，它需要 boost 头文件，并且需要包含目录中的“include”目录。 ... add_library(alib STATIC ...) target_include_direc
javascript - 传播 Promise 并在新对象中扩展
我有一些 promise 可以返回对象。现在我想将它们合并/扩展为一个新对象，因此我使用 Lodash's extend . var whenEverythingIsDone = Promise.a
scala - 传播 Scala 类型参数
这是我认为人们通常希望在 Scala 中做的事情，但如果我能在任何地方找到一个例子，我就该死了。这段代码由于类型删除而无法编译，但它演示了我正在努力完成的事情: def parse[T](json:
scala - 传播 Scala 类型参数
这是我认为人们通常希望在 Scala 中做的事情，但如果我能在任何地方找到一个例子，我就该死了。这段代码由于类型删除而无法编译，但它演示了我正在努力完成的事情: def parse[T](json:
Sharepoint default.master 传播？
我们有大量 MOSS 2007 站点需要添加大量的 javascript。我编辑、 checkin 、发布并批准了对 default.master 的更改，更改反射(reflect)在根网站上，但没有
jQuery:函数被调用两次。传播？为什么会出现这种情况？
请看一下下面的 fiddle :http://jsfiddle.net/K9NjY/ 我在这段代码上花了 3-4 个小时，并将其缩小到最短的版本，但现在我陷入了困境。问题:1. 点击“divOne”
java - Spring 集成中的错误处理/传播
我读到如果在流程中抛出异常，框架要做的第一件事就是检查消息头中的错误 channel 属性。总是这样吗？在我的特殊情况下，我将自定义错误 channel 分配给消息 header ，但该消息似乎已向
c++ - 不能通过carry让值(value)传播
创建一个小的 C++ 大型精度类，一切似乎都运行良好，但是添加，如果我将 0xffffffff 和 0x04 加在一起，我会得到 0xffff0003，而我应该得到 0x0100000003。这是有问
javascript - react : problems with . ..传播
我正在尝试重新创建 Dan Abramov 类(class)中的 Redux 示例。传播{...store.getState()}在应用程序级别不起作用，Redux 正在更改状态并且 React 不会
mysql - 传播.REQUIRES_NEW 锁定
考虑一个需要很长时间的事务。在此期间，我想对 TableSmall 执行一些小更新。，它应该立即执行，并且主事务的回滚不应该回滚那些小的更新。我当前的问题是这些小更新将锁定 TableSmall\
c - 如何处理子函数中的 const 传播
我需要对现有函数进行修改，具有一些 const 输入参数: int f(const owntype *r1, const owntype *r2) 为了做到这一点，我想调用一个使用相同类型但没有 co
c# - 传播 DependencyProperty 默认值
我有一个带有 ViewModel 的 WPF UserControl: 这个 UserControl 有一个 De
android - 停止 SMS 传播
我试图在收到这样的短信时不传播 public class SMSReceiver extends BroadcastReceiver { @Override public void onRec

首页

博学

6Ren·AI

商城

algorithm - 如何测试我的反向传播神经网络的实现是否正确