machine-learning - 神经网络如何学习功能而不是记住它们？-6ren

machine-learning - 神经网络如何学习功能而不是记住它们？

转载作者：行者123 更新时间：2023-11-30 09:33:32

24

4

对于一个班级项目，我设计了一个神经网络来近似sin（x），但最终得到了一个NN，它只是在给定数据点的位置记忆了我的功能。我的NN接受了批量为200的x值。每个x值都乘以200个不同的权重，映射到我的第一层中的200个不同的神经元。我的第一个隐藏层包含200个神经元，每个神经元都是批处理中x值的线性组合。我的第二个隐藏层也包含200个神经元，我的损失函数是在我的第二层的200个神经元与输入映射到的200个sin（x）值之间计算的。

问题是，我的NN完全“近似”损失为0的sin（x），但我知道它不会推广到其他数据点。

在设计该神经网络时，我做错了什么？如何避免记忆，而设计我的NN以“学习”数据中的模式？

最佳答案

任何机器学习算法都一样。您有一个数据集，您可以据此尝试学习“ the”函数f(x)，该函数实际生成了数据。在现实生活的数据集中，不可能从数据中获取原始函数，因此我们使用g(x)对其进行近似。

任何机器学习算法的主要目标是使用函数g(x)尽可能地预测看不见的数据。

给定一个数据集D，您始终可以训练一个模型，该模型可以完美地对所有数据点进行分类（您可以使用哈希图在训练集上获得0错误），但是过拟合或记忆化。

为避免此类情况，您必须确保模型不会记忆和学习该功能。有几件事可以做。我试图以非正式的方式（带有链接）将它们写下来。

培训，验证，测试

如果您有足够大的数据集，请使用训练，验证和测试拆分。将数据集分为三部分。通常，培训，验证和测试分别为60％，20％和20％。（这些数字可以根据需要而变化，如果数据不平衡，请检查如何获取stratified partitions来保留每次拆分中的类比率）。接下来，忘记测试分区，将其放在安全的地方，不要碰它。您的模型将使用“训练”分区进行训练。训练完模型后，请使用验证集评估模型的性能。然后为您的模型选择另一组超参数配置（例如，隐藏层数，学习算法，其他参数等），然后再次训练模型，并基于验证集进行评估。继续对几个这样的模型执行此操作。然后选择模型，该模型为您提供最佳的验证评分。

验证集在这里的作用是检查模型学到了什么。如果模型有过度拟合，那么验证分数将非常糟糕，因此在上述过程中，您将丢弃那些过度拟合模型。但是请记住，尽管您没有直接使用Validation集合来训练模型，但是使用了Validation集合来间接选择模型。

一旦选择了基于验证集的最终模型。现在，取出测试集，就好像您只是从现实生活中获得了新数据集一样，这是没人见过的。在该测试集上对模型的预测将表明您的模型在“学习”过程中的表现如何，因为该模型正在尝试预测从未见过的数据点（直接或间接）。

关键是不要回头根据测试得分来调整模型。这是因为一旦执行此操作，测试集将开始为您的模式做出贡献。

交叉验证和自举抽样

另一方面，如果您的数据集很小。您可以使用bootstrap sampling或k-fold cross-validation。这些想法是相似的。例如，对于k倍交叉验证，如果为k=5，则将数据集拆分为5个部分（也要注意分层抽样）。让我们将零件命名为a,b,c,d,e。使用分区[a,b,c,d]训练并仅在[e]上获得预测分数。接下来，使用分区[a,b,c,e]并仅对[d]使用预测得分，并继续进行5次，其中每次单独保留一个分区，并与其他4一起训练模型。此后，取平均值分数。这表明如果看到新数据，您的模型可能会执行。多次执行此操作并进行平均也是一个好习惯。例如，对于较小的数据集，执行10次10倍交叉验证，这将给出相当稳定的分数（取决于数据集），这将指示预测性能。

Bootstrap采样与此类似，但是您需要从数据集中替换相同数量的数据点（取决于），并使用该样本进行训练。该集合将重复一些数据点（因为它是一个带有替换的样本）。然后使用训练数据集中缺少的数据点来评估模型。多次执行此操作并平均性能。

其他

其他方法是将正则化技术合并到分类器成本函数本身中。例如，在Support Vector Machines, the cost function中强制执行条件，以使决策边界在两个类区域之间保持“边距”或间隙。在neural networks one can also do similar things中（尽管它与SVM中的相同）。

在神经网络中，您可以使用early stopping停止训练。这样做是在Train数据集上进行训练，但是在每个时期，它将评估Validation数据集上的性能。如果模型从特定时期开始过度拟合，那么Training数据集的误差将继续减小，但是Validation数据集的误差将开始增大，这表明您的模型过度拟合。基于此可以停止训练。

来自现实世界的大型数据集往往不会过度拟合（需要引用）。另外，如果模型中的参数太多（对于许多隐藏的单位和层来说），并且模型不必要地复杂，则它可能会过拟合。参数较小的模型永远不会过拟合（但是，如果参数太低，则可能会拟合不足）。

对于您的sin函数任务，神经网络必须过拟合，因为它本身就是... cc函数。这些测试确实可以帮助调试和试验您的代码。

另一个重要说明，如果您尝试对sin函数数据集生成的数据进行Train，Validation，Test或k-fold交叉验证，然后以“常规”方式将其拆分将不起作用，因为在这种情况下，正在处理时间序列，对于这种情况，可以使用技术mentioned here

关于machine-learning - 神经网络如何学习功能而不是记住它们？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/50263664/

24

4

0

文章推荐： javascript - 如何在 JQuery Steps 中有两个按钮

文章推荐： java - 多个 sql 查询与 Java 二进制搜索的效率

文章推荐： java - 在 Java 7 中播放声音

文章推荐： java - 使用java执行shell命令

c# - 学习 C# 有助于或阻碍 VB.NET 学习
关闭。这个问题是opinion-based .它目前不接受答案。想要改进这个问题？更新问题，以便 editing this post 可以用事实和引用来回答它. 关闭 9 年前。 Improve
学习.NET8MiniApis入门
介绍篇什么是MiniApis？ MiniApis的特点和优势 MiniApis的应用场景环境搭建系统要求安装MiniApis 配置开发环境基础概念 MiniApis架构概述
Javascript(学习)
我正在从“JavaScript 圣经”一书中学习 javascript，但我遇到了一些困难。我试图理解这段代码: function checkIt(evt) { evt = (evt) ? e
String.intern() 学习
package com.fastone.www.javademo.stringintern; /** * * String.intern()是一个Native方法， * 它的作用是：如果字
macos - 学习 AppleScript
您会推荐哪些资源来学习 AppleScript。我使用具有 Objective-C 背景的传统 C/C++。我也在寻找有关如何更好地开发和从脚本编辑器获取更快文档的技巧。示例提示是“查找要编写脚本的
java - 学习 OpenCMS
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。想改善这个问题吗？更新问题，使其成为 on-topic对于堆栈溢出。 4年前关闭。 Improve thi
extjs - 学习 ExtJS4
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。想改善这个问题吗？更新问题，使其成为 on-topic对于堆栈溢出。 7年前关闭。 Improve thi
f# - 学习 F#
关闭。这个问题不符合 Stack Overflow guidelines 。它目前不接受答案。想改善这个问题吗？更新问题，以便堆栈溢出为 on-topic。 6年前关闭。 Improve this
flutter - 学习 flutter
我是塞内加尔的阿里。我今年60岁(也许这是我真正的问题-笑脸!!!)。我正在学习Flutter和Dart。今天，我想使用给定数据模型的列表(它的名称是Mortalite，请参见下面的代码)。我尝试
powershell - 学习……真的什么都行
关闭。这个问题是off-topic .它目前不接受答案。想改进这个问题？ Update the question所以它是on-topic对于堆栈溢出。 9年前关闭。 Improve this que
cappuccino - 学习 Cappuccino
学习 Cappuccino 的最佳来源是什么？我从事“传统”网络开发，但我对这个新框架非常感兴趣。请注意，我对 Objective-C 毫无了解。最佳答案如上所述，该网站是一个好地方，但还有一些其
java - 学习 HashMap
我正在学习如何使用 hashMap，有人可以检查我编写的这段代码并告诉我它是否正确吗？这个想法是有一个在公司工作的员工列表，我想从 hashMap 添加和删除员工。 public class Staf
jQuery CoffeeScript - 学习
我正在尝试将 jQuery 与 CoffeScript 一起使用。我按照博客中的说明操作，指示使用 $ -> 或 jQuery -> 而不是 .ready() 。我玩了一下代码，但我似乎无法理解我出错
javascript - PHP传递参数给新的字符串(学习)
还在学习，还有很多问题，所以这里有一些。我正在进行 javascript -> PHP 转换，并希望确保这些做法是正确的。是$dailyparams->$calories = $calories;一条
MySQL 使用临时表(学习)
我目前正在学习 SQL，以便从我们的 Magento 数据库制作一个简单的 RFM 报告，我目前可以通过导出两个查询并将它们粘贴到 Excel 模板中来完成此操作，我想摆脱 Excel 模板。我认为
Javascript > PHP (学习)
我知道我很可能会因为这个问题而受到抨击，但没有人问，我求助于你。这是否是一个正确的 javascript > php 转换 - 在我开始不良做法之前，我想知道这是否是解决此问题的正确方法。 JavaS
ruby - 学习/平铺的资源
除了 Ruby-Doc 之外，哪些来源最适合获取一些示例和教程，尤其是关于 Ruby 中的 Tk/Tile？我发现自己更正常了 http://www.tutorialspoint.com/ruby/r
Python 学习。为什么我只在第一次收到警告？
我只在第一次收到警告。这正常吗？ >>> cv=LassoCV(cv=10).fit(x,y) C:\Python27\lib\site-packages\scikit_learn-0.14.1-py
java - 学习/复习Java
按照目前的情况，这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持，但这个问题可能会引发辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开，visit the
c# - 学习.NET
As it currently stands, this question is not a good fit for our Q&A format. We expect answers to be

首页

博学

6Ren·AI

商城

machine-learning - 神经网络如何学习功能而不是记住它们？