c++ - 训练 NN 计算 atan2(y, x)-6ren

c++ - 训练 NN 计算 atan2(y, x)

转载作者：行者123 更新时间：2023-11-30 08:51:17

25

4

我一直在研究 Q 强化学习实现，其中 Q(π, a) 是用神经网络近似的。在故障排除过程中，我将问题简化为非常简单的第一步:训练神经网络来计算 atan2(y, x)。

我正在使用 FANN 来解决这个问题，但该库在很大程度上无关紧要，因为这个问题更多的是关于要使用的适当技术。

我一直在努力教导神经网络，给定输入 = {x, y}，计算输出 = atan2(y, x)。

这是我一直在使用的简单方法。这是非常简单的，但我试图保持这个简单以便于工作。

#include "fann.h"
#include <cstdio>
#include <random>
#include <cmath>

int main()
{
    // creates a 3 layered, densely connected neural network, 2-3-1
    fann *ann = fann_create_standard(3, 2, 3, 1);

    // set the activation functions for the layers
    fann_set_activation_function_hidden(ann, FANN_SIGMOID_SYMMETRIC);
    fann_set_activation_function_output(ann, FANN_SIGMOID_SYMMETRIC);

    fann_type input[2];
    fann_type expOut[1];
    fann_type *calcOut;

    std::default_random_engine rng;
    std::uniform_real_distribution<double> unif(0.0, 1.0);
    for (int i = 0; i < 100000000; ++i) {
        input[0] = unif(rng);
        input[1] = unif(rng);

        expOut[0] = atan2(input[1], input[0]);

        // does a single incremental training round
        fann_train(ann, input, expOut);
    }


    input[0] = unif(rng);
    input[1] = unif(rng);

    expOut[0] = atan2(input[1], input[0]);
    calcOut = fann_run(ann, input);

    printf("Testing atan2(%f, %f) = %f -> %f\n", input[1], input[0], expOut[0], calcOut[0]);

    fann_destroy(ann);
    return 0;
}

super 简单，对吧？然而，即使经过 100,000,000 次迭代，该神经网络也会失败:

Testing atan2(0.949040, 0.756997) = 0.897493 -> 0.987712

我还尝试在输出层上使用线性激活函数 (FANN_LINEAR)。没有运气。事实上，结果要糟糕得多。经过 100,000,000 次迭代后，我们得到:

Testing atan2(0.949040, 0.756997) = 0.897493 -> 7.648625

这比随机初始化权重时更糟糕。训练后神经网络怎么会变得更糟？

我发现 FANN_LINEAR 的这个问题与其他测试一致。当需要线性输出时(例如，在计算 Q 值时，它对应于任意大或小的奖励)，这种方法会严重失败，并且错误实际上似乎会随着训练而增加。

所以这是怎么回事？使用全连接的 2-3-1 神经网络是否不适合这种情况？隐藏层中的对称 sigmoid 激活函数是否不合适？我看不出还有什么可能导致此错误。

最佳答案

您面临的问题是正常的，并且预测器的质量不会通过增加迭代次数来提高，您应该通过添加一些层或增加隐藏层的大小来增加神经网络的大小层。例如，您可以尝试 2-256-128-1，而不是 2-3-1。通常这样会效果更好。如果你想看看这个 simple code我用 python 编写来完成相同的任务，并且运行良好

import numpy as np
from numpy import arctan2

from keras.models import Sequential 
from keras.layers import Dense, InputLayer



nn_atan2 = Sequential()
nn_atan2.add(Dense(256, activation="sigmoid", input_shape=(2,)))
nn_atan2.add(Dense(128, activation="sigmoid"))
nn_atan2.add(Dense(1, activation='tanh'))

nn_atan2.compile(optimizer="adam", loss="mse")
nn_atan2.summary()

N = 100000
X = np.random.uniform(size=(N,2) )
y = arctan2(X[:,0], X[:,1])/(np.pi*0.5)

nn_atan2.fit(X,y, epochs=10, batch_size=128)

def predict(x, y):
    return float(nn_atan2.predict(np.array([[x, y]]))*(np.pi*0.5))

运行这段代码会给出

Epoch 1/10
100000/100000 [==============================] - 3s 26us/step - loss: 0.0289
Epoch 2/10
100000/100000 [==============================] - 2s 24us/step - loss: 0.0104
Epoch 3/10
100000/100000 [==============================] - 2s 24us/step - loss: 0.0102
Epoch 4/10
100000/100000 [==============================] - 2s 24us/step - loss: 0.0096
Epoch 5/10
100000/100000 [==============================] - 2s 24us/step - loss: 0.0082
Epoch 6/10
100000/100000 [==============================] - 2s 23us/step - loss: 0.0051
Epoch 7/10
100000/100000 [==============================] - 2s 23us/step - loss: 0.0027
Epoch 8/10
100000/100000 [==============================] - 2s 23us/step - loss: 0.0019
Epoch 9/10
100000/100000 [==============================] - 2s 23us/step - loss: 0.0014
Epoch 10/10
100000/100000 [==============================] - 2s 23us/step - loss: 0.0010

关于c++ - 训练 NN 计算 atan2(y, x)，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/59691534/

25

4

0

文章推荐： java - Camel 文件组件 URI 格式

文章推荐： python - model.eval() 在 pytorch 中做什么？

文章推荐： artificial-intelligence - 聚合概率计划

regex - 是否有正则表达式来替换 VIM 中 nn :nn:nn. nn 中的前导零(最后一个除外)和冒号？
在 Vim 中，我打开了一个基本结构如下的文件: 3677137 00:01:47.04 666239 00:12:57.86 4346 00:00:01.77 418 00:00:0
python - [nn.nn] 或 [nn] 的正则表达式，具有更正的分组
我正在尝试构建一个正则表达式来处理以字符串形式呈现给我的数据类型，有两种可能的格式: 字符串[nmin..nmax] 字符串[nmax] 其中 nmin 和 nmax 是一些数字。我构建了适合我的正
logging - tensorflow log_softmax tf.nn.log(tf.nn.softmax(predict)) tf.nn.softmax_cross_entropy_with_logits
我尝试按照 tensorflow 教程实现 MNIST CNN 神经网络，并找到这些实现 softmax 交叉熵的方法给出了不同的结果: (1) 不好的结果 softmax = tf.nn.softm
pytorch - 什么时候应该使用 nn.ModuleList，什么时候应该使用 nn.Sequential？
我是 Pytorch 的新手，我不太了解的一件事是 nn.ModuleList 的用法。和 nn.Sequential .我能知道什么时候应该使用一个而不是另一个吗？谢谢。最佳答案 nn.Modul
pytorch - 一起使用 nn.Linear() 和 nn.BatchNorm1d()
我不明白当数据为 3D 时 BatchNorm1d 如何工作(批量大小、H、W)。示例输入大小:(2,50,70) 图层:nn.Linear(70,20) 输出大小:(2,50,20) 如果我随后
python - NLTK 正则表达式模式中 * 和 * 之间有什么区别？
我浏览了chapter 7 NLTK 书中的内容正在寻找解决方案，但到目前为止我还不清楚。 *表示 0 个或多个名词 *正如书中所解释的，意思是0个或多个任何类型的名词 NLTK 中是 NN , NN
python - nn.MaxPool2d 与 nn.function.max_pool2d 之间的区别？
:nn.MaxPool2d(kernel_size, stride) 和 nn.function.max_pool2d(t, kernel_size, stride) 之间有什么区别？我在模块中定义
Hadoop 高可用性。配置了自动故障转移，但备用 NN 在 NN 再次启动之前不会变为事件状态
我正在使用 Hadoop 2.6.0-cdh5.6.0。我已经配置了 HA。我显示了事件(NN1)和备用名称节点(NN2)。现在，当我向事件名称节点(NN1)发出终止信号时，备用名称节点(NN2)不会
Pytorch:为什么在 nn.modules.loss 和 nn.functional 模块中都实现了损失函数？
Pytorch 中的许多损失函数都在 nn.modules.loss 和 nn.functional 中实现。例如，下面的两行返回相同的结果。 import torch.nn as nn impor
Tensorflow，tf.nn.softmax_cross_entropy_with_logits 和 tf.nn.sparse_softmax_cross_entropy_with_logits 的区别
我已阅读 docs of both functions ，但据我所知，对于函数 tf.nn.softmax_cross_entropy_with_logits(logits, labels, dim=
tensorflow - tf.nn.fused_batch_norm 返回的方差与 tf.nn.moments 不同
当我尝试比较 tf.nn.fused_batch_norm 的方差输出和 tf.nn.moments 的方差输出时，对于相同的输入，我没有相同的值。 import numpy as np import
tensorflow - tf.nn.fused_batch_norm 返回的方差与 tf.nn.moments 不同
当我尝试比较 tf.nn.fused_batch_norm 的方差输出和 tf.nn.moments 的方差输出时，对于相同的输入，我没有相同的值。 import numpy as np import
python - torch.nn.sequential 与多个 torch.nn.linear 的组合
这个问题在这里已经有了答案: Are there any computational efficiency differences between nn.functional() Vs nn.seq
java - 一旦主 NN 出现故障，自动从 Java 应用程序连接到 HDFS 辅助 NN
我有一个简单的 Java 客户端，可以将文件保存到 HDFS - 配置了 1 个名称节点。为此，我使用 hadoop 配置，指定默认文件系统，如: org.apache.hadoop.conf.Con
sql - 在 SQL Server 中，转换具有这种格式的 varchar (nnn :nn:nn)
我将此 varchar 格式作为时间累积，我想将其转换为整数以执行 SUM 并获得一组的总时间。第一部分可以是1、2、3、4甚至5位数字，代表小时数的累加，然后用冒号隔开。然后是第二部分，即分钟的累积
lstm - nn.LSTMCell 的 torch 0.4.0 nn.LayerNorm 示例的任何示例？
在 pytorch 0.4.0 版本中，有一个 nn.LayerNorm模块。我想在我的 LSTM 网络中实现这一层，尽管我在 LSTM 网络上找不到任何实现示例。 pytorch 贡献者暗示这 n
python-3.x - PyTorch 中的 nn.functional() 与 nn.sequential() 之间是否存在计算效率差异
以下是使用 PyTorch 中的 nn.functional() 模块的前馈网络 import torch.nn as nn import torch.nn.functional as F class
nhibernate - 当数据库中的列为 Null 时，是什么导致了 "Invalid index nn for this SqlParameterCollection with Count=nn"？
对于住宿实体，我们有两列可以为空:CollectionType和 AccommodationUnitType . 但是我注意到在数据中它们被设置为零而不是空，导致 NHibernate 尝试查找 id
python - 如何在 Python 中使用 NLTK 仅将具有以下模式 * *"run in" 的句子分块？
我只需要分块那些只有那种模式的短语，而不是再分块一次。我在 Python 中使用 NLTK 库完成了它，但不起作用 import nltk import re document="they run
python - 是否可以自动调整 PyTorch 中 torch.nn.Sequential 中 torch.nn.Flatten 之后的层的后续输入？
例如，如果我有以下模型类: class MyTestModel(nn.Module): def __init__(self): super(MyTestModel, self)

首页

博学

6Ren·AI

商城

c++ - 训练 NN 计算 atan2(y, x)