- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在训练输入长度不同的 GRU 层。因此,我用 0.0 填充了输入的特征,使所有序列的长度相同。另一方面,只要输入特征向量全为零,我不想在任何时间步计算任何样本的任何损失。例如,在时间步长为 1000 时,我的批量大小为 34,但该批处理的样本编号 33 和 34 在时间步长为 1000 时缺少数据或特征值。
我发现我们可以在 Keras 中使用 Masking()(inputs)
方法,只要所有后续层或操作都支持 masking
。但是我已经在 tensorflow 中实现了我的模型。那么tensorflow中Masking()
的等价物是什么?
其次,我如何知道:batch normalization
、conv
层和任何非线性激活
函数是否支持 Keras 中的 masking()
函数?
非常感谢您的帮助!!
最佳答案
于是在danijar博客中找到了详细的解决方案https://danijar.com/variable-sequence-lengths-in-tensorflow/ .
当序列不完整时,使用 keras 中的掩码。所以通常,你需要在第三个维度(特征的维度;当输入维度具有 shape = [batch_size, sequence_length, num_features]
)中用 0.0 填充你的序列。之后,keras 中的掩码将取一个数字,将为它们的激活输出 0。
总结:他展示了如何使用他实现的 length()
计算批处理中每个样本的序列长度。然后将输出向量送入 dynamic_rnn
,它将为不完整序列(状态和输出)输出零向量,这在某种程度上类似于 Keras Masking()
中发生的情况功能。其次,我们应该在计算损失函数时使用mask
。
所有细节都在这篇博文中讨论。
但是关于在batch_norm
、conv
和非线性激活函数
中对掩码的支持;通常,如果 LSTM
的输出为零;然后如果输出有 sigmoid
激活函数;输出关于 sigmoid 函数输入的导数是 output(1 - output)
。因此,当输出为 0 时,该导数也为零。由于反向传播应用了链式法则,因此当前样本相对于网络中任何权重参数的梯度也将为 0。因此,无需担心支持问题......但是当激活是 relu 时问题就出现了,例如,在进行反向传播之前,梯度应该明确地乘以零(我猜)。也许做这样的事情会有所帮助:
final_output = output * mask
然后 final_output
相对于 output
的导数将是掩码 => 0 或 1(任何时间步;对于任何样本)。然后,将此梯度从激活函数的 output
反向传播到其输入...后跟链式法则 => 在这种情况下权重不会受到影响。
关于tensorflow - tensorflow 中 Masking() Keras 函数的等效性是什么?还有batch norm、conv、relu支持Masking吗?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/51789338/
C语言sscanf()函数:从字符串中读取指定格式的数据 头文件: ?
最近,我有一个关于工作预评估的问题,即使查询了每个功能的工作原理,我也不知道如何解决。这是一个伪代码。 下面是一个名为foo()的函数,该函数将被传递一个值并返回一个值。如果将以下值传递给foo函数,
CStr 函数 返回表达式,该表达式已被转换为 String 子类型的 Variant。 CStr(expression) expression 参数是任意有效的表达式。 说明 通常,可以
CSng 函数 返回表达式,该表达式已被转换为 Single 子类型的 Variant。 CSng(expression) expression 参数是任意有效的表达式。 说明 通常,可
CreateObject 函数 创建并返回对 Automation 对象的引用。 CreateObject(servername.typename [, location]) 参数 serv
Cos 函数 返回某个角的余弦值。 Cos(number) number 参数可以是任何将某个角表示为弧度的有效数值表达式。 说明 Cos 函数取某个角并返回直角三角形两边的比值。此比值是
CLng 函数 返回表达式,此表达式已被转换为 Long 子类型的 Variant。 CLng(expression) expression 参数是任意有效的表达式。 说明 通常,您可以使
CInt 函数 返回表达式,此表达式已被转换为 Integer 子类型的 Variant。 CInt(expression) expression 参数是任意有效的表达式。 说明 通常,可
Chr 函数 返回与指定的 ANSI 字符代码相对应的字符。 Chr(charcode) charcode 参数是可以标识字符的数字。 说明 从 0 到 31 的数字表示标准的不可打印的
CDbl 函数 返回表达式,此表达式已被转换为 Double 子类型的 Variant。 CDbl(expression) expression 参数是任意有效的表达式。 说明 通常,您可
CDate 函数 返回表达式,此表达式已被转换为 Date 子类型的 Variant。 CDate(date) date 参数是任意有效的日期表达式。 说明 IsDate 函数用于判断 d
CCur 函数 返回表达式,此表达式已被转换为 Currency 子类型的 Variant。 CCur(expression) expression 参数是任意有效的表达式。 说明 通常,
CByte 函数 返回表达式,此表达式已被转换为 Byte 子类型的 Variant。 CByte(expression) expression 参数是任意有效的表达式。 说明 通常,可以
CBool 函数 返回表达式,此表达式已转换为 Boolean 子类型的 Variant。 CBool(expression) expression 是任意有效的表达式。 说明 如果 ex
Atn 函数 返回数值的反正切值。 Atn(number) number 参数可以是任意有效的数值表达式。 说明 Atn 函数计算直角三角形两个边的比值 (number) 并返回对应角的弧
Asc 函数 返回与字符串的第一个字母对应的 ANSI 字符代码。 Asc(string) string 参数是任意有效的字符串表达式。如果 string 参数未包含字符,则将发生运行时错误。
Array 函数 返回包含数组的 Variant。 Array(arglist) arglist 参数是赋给包含在 Variant 中的数组元素的值的列表(用逗号分隔)。如果没有指定此参数,则
Abs 函数 返回数字的绝对值。 Abs(number) number 参数可以是任意有效的数值表达式。如果 number 包含 Null,则返回 Null;如果是未初始化变量,则返回 0。
FormatPercent 函数 返回表达式,此表达式已被格式化为尾随有 % 符号的百分比(乘以 100 )。 FormatPercent(expression[,NumDigitsAfterD
FormatNumber 函数 返回表达式,此表达式已被格式化为数值。 FormatNumber( expression [,NumDigitsAfterDecimal [,Inc
我是一名优秀的程序员,十分优秀!