- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我尝试在 PyTorch 论坛上提出这个问题,但没有得到任何回应,所以我希望这里有人可以帮助我。此外,如果有人有使用变压器模块的好例子,请分享它,因为文档仅显示使用简单的线性解码器。对于变压器,我知道我们通常会输入实际的目标序列。因此,我的第一个问题是,在转换器之前,我有一个标准线性层来转换我的时间序列序列以及位置编码。根据文档,变压器模块代码 src 和 trg 序列需要具有相同的维度。
from torch.nn.modules.transformer import Transformer
class TransformerTimeSeries(torch.nn.Module):
def __init__(self, n_time_series, d_model=128):
super()._init__()
self.dense_shape = torch.nn.Linear(n_time_series, d_model)
self.pe = SimplePositionalEncoding(d_model)
self.transformer = Transformer(d_model, nhead=8)
所以我想知道我可以简单地做这样的事情还是会以某种方式泄露有关目标的信息?我仍然不确定 loss.backward() 是如何工作的,所以我不确定这是否会导致问题。
def forward(self, x, t):
x = self.dense_shape(x)
x = self.pe(x)
t = self.dense_shape(t)
t = self.pe(t)
x = self.transformer(x, t)
其次,目标序列是否需要任何形式的偏移?例如,如果我有时间序列
[0,1,2,3,4,5,6,7]
我想喂
[0,1,2,3]
预测
[4,5,6,7]
(tgt)?我会像那样简单地喂它还是更复杂?通常 BERT 和那些模型有 [CLS] 和 [SEP] 标记来表示句子的开头和结尾,但是对于时间序列,我假设我不需要分隔时间步长。
最佳答案
loss.backward()
遍历模型的梯度图,沿途更新各个分量的梯度。您可以使用名为 PytorchViz 的辅助库查看图表。 .以下是您可以使用此库进行可视化的示例:
无论您是否使用它,看起来您都在为目标和输入使用相同的密集层。由于密集层将跟踪梯度,因此它将计算目标的梯度另外到梯度输入,这确实会导致模型基于目标序列进行学习。
至于你的第二个问题。我想喂模型[0,1,2,3]
为了预测 [4,5,6,7]
将根据您使用的数据正常工作。如果您使用的是周期性信号(即心电图时间序列、sinx
等),我认为它会做得很好,无需进一步复杂化。
但是,如果您想预测某些事件,例如句子结束或价格预测(例如交易日结束),那么您将需要添加代币来创建一个健壮的模型(并不是说没有它们它会失败,但它肯定会有所帮助预测精度)。
关于python - 使用完整的 PyTorch 变压器模块,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/58733721/
我最近在我的机器上安装了 cx_Oracle 模块,以便连接到远程 Oracle 数据库服务器。 (我身边没有 Oracle 客户端)。 Python:版本 2.7 x86 Oracle:版本 11.
我想从 python timeit 模块检查打印以下内容需要多少时间,如何打印, import timeit x = [x for x in range(10000)] timeit.timeit("
我盯着 vs 代码编辑器上的 java 脚本编码,当我尝试将外部模块包含到我的项目中时,代码编辑器提出了这样的建议 -->(文件是 CommonJS 模块;它可能会转换为 ES6 模块。 )..有什么
我有一个 Node 应用程序,我想在标准 ES6 模块格式中使用(即 "type": "module" in the package.json ,并始终使用 import 和 export)而不转译为
我正在学习将 BlueprintJS 合并到我的 React 网络应用程序中,并且在加载某些 CSS 模块时遇到了很多麻烦。 我已经安装了 npm install @blueprintjs/core和
我需要重构一堆具有这样的调用的文件 define(['module1','module2','module3' etc...], function(a, b, c etc...) { //bun
我是 Angular 的新手,正在学习各种教程(Codecademy、thinkster.io 等),并且已经看到了声明应用程序容器的两种方法。首先: var app = angular.module
我正在尝试将 OUnit 与 OCaml 一起使用。 单元代码源码(unit.ml)如下: open OUnit let empty_list = [] let list_a = [1;2;3] le
我在 Angular 1.x 应用程序中使用 webpack 和 ES6 模块。在我设置的 webpack.config 中: resolve: { alias: { 'angular':
internal/modules/cjs/loader.js:750 return process.dlopen(module, path.toNamespacedPath(filename));
在本教程中,您将借助示例了解 JavaScript 中的模块。 随着我们的程序变得越来越大,它可能包含许多行代码。您可以使用模块根据功能将代码分隔在单独的文件中,而不是将所有内容都放在一个文件
我想知道是否可以将此代码更改为仅调用 MyModule.RED 而不是 MyModule.COLORS.RED。我尝试将 mod 设置为变量来存储颜色,但似乎不起作用。难道是我方法不对? (funct
我有以下代码。它是一个 JavaScript 模块。 (function() { // Object var Cahootsy; Cahootsy = { hello:
关闭。这个问题是 opinion-based 。它目前不接受答案。 想要改进这个问题?更新问题,以便 editing this post 可以用事实和引文来回答它。 关闭 2 年前。 Improve
从用户的角度来看,一个模块能够通过 require 加载并返回一个 table,模块导出的接口都被定义在此 table 中(此 table 被作为一个 namespace)。所有的标准库都是模块。标
Ruby的模块非常类似类,除了: 模块不可以有实体 模块不可以有子类 模块由module...end定义. 实际上...模块的'模块类'是'类的类'这个类的父类.搞懂了吗?不懂?让我们继续看
我有一个脚本,它从 CLI 获取 3 个输入变量并将其分别插入到 3 个变量: GetOptions("old_path=s" => \$old_path, "var=s" =
我有一个简单的 python 包,其目录结构如下: wibble | |-----foo | |----ping.py | |-----bar | |----pong.py 简单的
这种语法会非常有用——这不起作用有什么原因吗?谢谢! module Foo = { let bar: string = "bar" }; let bar = Foo.bar; /* works *
我想运行一个命令: - name: install pip shell: "python {"changed": true, "cmd": "python <(curl https://boot
我是一名优秀的程序员,十分优秀!