- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我正在尝试创建一个图像字幕模型。你能帮忙解决这个错误吗? input1 是图像向量,input2 是字幕序列。 32 是字幕长度。我想将图像向量与序列的嵌入连接起来,然后将其提供给解码器模型。
def define_model(vocab_size, max_length):
input1 = Input(shape=(512,))
input1 = tf.keras.layers.RepeatVector(32)(input1)
print(input1.shape)
input2 = Input(shape=(max_length,))
e1 = Embedding(vocab_size, 512, mask_zero=True)(input2)
print(e1.shape)
dec1 = tf.concat([input1,e1], axis=2)
print(dec1.shape)
dec2 = LSTM(512)(dec1)
dec3 = LSTM(256)(dec2)
dec4 = Dropout(0.2)(dec3)
dec5 = Dense(256, activation="relu")(dec4)
output = Dense(vocab_size, activation="softmax")(dec5)
model = tf.keras.Model(inputs=[input1, input2], outputs=output)
model.compile(loss="categorical_crossentropy", optimizer="adam")
print(model.summary())
return model
ValueError: Input 0 of layer lstm_5 is incompatible with the layer: expected ndim=3, found ndim=2. Full shape received: [None, 512]
最佳答案
当 LSTM 层以 2D 而不是 3D 形式获取输入时,会发生此错误。例如:
(64, 100)
正确的格式是
(n_samples, time_steps, features)
:
(64, 5, 100)
在这种情况下,你做的错误是输入了
dec3
,这是一个 LSTM 层,是
dec2
的输出,这也是一个 LSTM 层。默认情况下,参数
return_sequences
在 LSTM 层中是
False
.这意味着第一个 LSTM 返回了一个 2D 张量,它与下一个 LSTM 层不兼容。我通过设置
return_sequences=True
解决了您的问题在你的第一个 LSTM 层。
model = tf.keras.Model(inputs=[input1, input2], outputs=output)
input1
不是输入层,因为您重新分配了它。看:
input1 = Input(shape=(512,))
input1 = tf.keras.layers.RepeatVector(32)(input1)
我重命名了第二个
e0
,与您命名变量的方式一致。
import tensorflow as tf
from tensorflow.keras.layers import *
from tensorflow.keras import Input
vocab_size, max_length = 1000, 32
input1 = Input(shape=(128))
e0 = tf.keras.layers.RepeatVector(32)(input1)
print(input1.shape)
input2 = Input(shape=(max_length,))
e1 = Embedding(vocab_size, 128, mask_zero=True)(input2)
print(e1.shape)
dec1 = Concatenate()([e0, e1])
print(dec1.shape)
dec2 = LSTM(16, return_sequences=True)(dec1)
dec3 = LSTM(16)(dec2)
dec4 = Dropout(0.2)(dec3)
dec5 = Dense(32, activation="relu")(dec4)
output = Dense(vocab_size, activation="softmax")(dec5)
model = tf.keras.Model(inputs=[input1, input2], outputs=output)
model.compile(loss="categorical_crossentropy", optimizer="adam")
print(model.summary())
Model: "model_2"
_________________________________________________________________________________
Layer (type) Output Shape Param # Connected to
=================================================================================
input_24 (InputLayer) [(None, 128)] 0
_________________________________________________________________________________
input_25 (InputLayer) [(None, 32)] 0
_________________________________________________________________________________
repeat_vector_12 (RepeatVector) (None, 32, 128) 0 input_24[0][0]
_________________________________________________________________________________
embedding_11 (Embedding) (None, 32, 128) 128000 input_25[0][0]
_________________________________________________________________________________
concatenate_7 (Concatenate) (None, 32, 256) 0 repeat_vector_12[0][0]
embedding_11[0][0]
_________________________________________________________________________________
lstm_12 (LSTM) (None, 32, 16) 17472 concatenate_7[0][0]
_________________________________________________________________________________
lstm_13 (LSTM) (None, 16) 2112 lstm_12[0][0]
_________________________________________________________________________________
dropout_2 (Dropout) (None, 16) 0 lstm_13[0][0]
_________________________________________________________________________________
dense_4 (Dense) (None, 32) 544 dropout_2[0][0]
_________________________________________________________________________________
dense_5 (Dense) (None, 1000) 33000 dense_4[0][0]
=================================================================================
Total params: 181,128
Trainable params: 181,128
Non-trainable params: 0
_________________________________________________________________________________
关于python - 层 lstm_5 的输入 0 与层 : expected ndim=3, 不兼容,发现 ndim=2,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/62395559/
就目前而言,这个问题不适合我们的问答形式。我们希望答案得到事实、引用资料或专业知识的支持,但这个问题可能会引发辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开,visit the
我是脚本新手。如何编写 Expect 脚本以通过 ssh 连接到设备并提示用户输入密码?我们使用 pin + RSA token 代码作为密码,因此我无法存储密码。 #!/usr/bin/expect
我编写了以下代码并尝试执行它。但我在执行 do {”时遇到“无效的命令名称“do”” 代码: #!/usr/bin/expect set val 0; set input 5; do { pu
我已经查看了 Expect 联机帮助页并用 Google 搜索了它,但我还没有找到 expect 的 -r 是什么。我看到这个选项以前是这样用的 expect -r "\r\n\r\n" 在 expe
我的 shebang 看起来像这样: #!/usr/bin/expect -d 当我从命令行运行脚本时,它会提供我想要的内容。 但是,我通过 crontab 运行这个脚本。是否可以将调试开关保持打开状
我是 Expect 脚本的新手。 我在 Linux 机器上为 ssh 编写了一个 Expect 脚本,在那里我在 ssh 到不同的 Linux 机器时遇到了问题。下面我复制了脚本。 !/usr/loc
Scene 1, Layer 'script', Frame 1, Line 9 1084: Syntax error: expecting identifier before this. Sc
我正在运行调试命令以将命令的输出记录到文件中。我尝试了 log_file 命令,但它没有记录输出。我的代码如下: log_file -a gdb.txt send "~/debugulator.sh
我希望 expect_user 有一个无限的(或非常大的)超时和 expect 的默认超时。有没有办法设置不同的超时?或者我是否只需要在每次更改用途之前手动执行此操作? 最佳答案 expect 和ex
我正在学习 iOS 编程(我来自 Android),我正在寻找更容易获取字符串的方法。有了这个建议,我定义了下一个宏并在一些代码片段中使用它: #define STRING_BASE @"InfoPl
你好我是 rspec 的新手,我想弄清楚将 block 传递给 expect{} 和只使用 expect() 之间的区别 这是一个简单的例子 require "rails_helper" RSpec.
我正在尝试为 React JS 运行单元测试 - 使用 jest/enzyme。 目前测试失败。不太清楚为什么,也许我没有正确调用 expect(wrapper.find)。这是我测试的一部分: F
例如,现在我有一个“root.exp”期望脚本如下: spawn ssh user@ip expect "Password:" send "password" 然后,我要发送到这个ssh服务器的exp
您好,我是 Expect 脚本编写的新手,我一直在尝试使用以下方法将 IP 地址获取到变量中: set timeout -1 spawn $env(SHELL) match_max 100000 se
expect.anything() 不适用于 expect.toBe(),但适用于 expect.toEqual() test("this will pass", () => { expect("
我有一个如下所示的简单脚本,从命令行读取 2 个数字并将它们加在一起: $cat runexp.sh #!/bin/bash echo "read 1st number" read n1 echo "
当 Linux 机器的 $IP 登录后询问密码时,下面的 expect 脚本工作正常 但在某些情况下,某些Linux机器不需要ssh密码(我们可以不用密码登录), 所以我需要更改我的期望脚本以支持没有
我正在尝试使用 expect 远程登录服务器并更改用户密码。该应用程序要求,如果您要更改的密码包含特殊字符,则将其引用。问题是,还需要引用 expect send 语句,当我尝试将两者结合起来时,脚本
下面这个简单的 expect 脚本的目标是获取远程机器上的 hostname 名称 有时期望脚本无法执行到 $IP_ADDRESS 的 ssh(因为远程机器不活动等) 所以在这种情况下,expect
我试图创建一个宏来替换, first: Some(first.as_ref().parse::().expect("Could not parse 'first'")) 我在其他模块(如 Clap w
我是一名优秀的程序员,十分优秀!