python - CNN 中的 Tensorflow 可变动态大小-6ren

python - CNN 中的 Tensorflow 可变动态大小

转载作者：行者123 更新时间：2023-11-30 09:05:13

35

4

我的 CNN 的输出层应该使用 RBF 函数，描述为“每个神经元输出其输入向量与其权重向量之间的欧几里德距离的平方”。我已将其实现为

dense2 = tf.square(tf.norm(dense1 - tf.transpose(dense2_W)))

其中 dense1 是形状 (?, 84) 的张量。我尝试将权重 dense2_W 声明为形状 (84, 10) 的变量，因为它正在进行数字分类并且应该有 10 个输出。批量运行 100 个代码时，我收到此错误:InvalidArgumentError:不兼容的形状:[100,84] 与 [10,84]。我相信这是由于减法造成的。

我通过迭代此代码来训练网络:

x_batch, y_batch = mnist.train.next_batch(100)
x_batch = tf.pad(x_batch, [[0,0],[2,2],[2,2],[0,0]]).eval()  # Pad 28x28 -> 32x32
sess.run(train_step, {X: x_batch, Y: y_batch})

然后使用整个测试集进行测试，因此网络中的批量大小必须是动态的。

我该如何解决这个问题？批量大小必须是动态的，如 dense1 的情况一样，但我不明白如何创建具有动态大小的变量并对其进行转置 (dense2_W)。

最佳答案

您需要两个张量的形状匹配。假设您希望在批处理中共享权重，并且还为每个输出类拥有单独的权重集，您可以 reshape 两个张量以便正确广播，例如:

# broadcasting will copy the input to every output class neuron
input_dense = tf.expand_dims(dense1, axis=2)

# broadcasting here will copy the weights across the batch
weights = tf.expand_dims(tf.transpose(dense2_W), axis=0)

dense2 = tf.square(tf.norm(input_dense - weights, axis=1))

生成的张量 dense2 的形状应为 [batch_size, num_classes]，在您的情况下为 [100, 10] (所以它将保存超过输出类数量的每个数据实例的 logits)

编辑:在 tf.norm 调用中添加了 axis 参数，以便在隐藏维度中计算距离(而不是在整个矩阵上)。

关于python - CNN 中的 Tensorflow 可变动态大小，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/53793773/

35

4

0

文章推荐： python-3.x - 运行经过训练的机器学习模型时出现错误

文章推荐： java -/etc/init.d 中启动时的 Unix 脚本不工作

文章推荐： java - 通过 wsadmin (WAS 8.5) 获取模块版本

文章推荐： python - 属性错误: 'Tensor' object has no attribute 'compile'

f# - 类型定义中的“可变”
为什么禁用类型像 type t = A of int | B of string * mutable int 虽然允许此类类型: type t = A of int | B of string * i
Python 可变 NamedTuple
我正在寻找一种类似结构的数据结构，我可以从中创建多个实例并具有某种类型提示而不是不可变的。所以我有这样的东西: class ConnectionConfig(NamedTuple): nam
Swift:间接访问/可变
我需要转到引用的结构: class SearchKnot { var isWord : Bool = false var text : String = "" var to
javascript - 可变/词法环境
如sec 10.4.3中所述当控制进入执行时，执行以下步骤功能对象F（调用者）中包含的功能代码的上下文提供thisArg，而调用方提供argumentsList：如
iphone - 使用事件指示器和标签显示警报(可变)
i make a game that start display Activity indicator And activity indicator bottom display UiLable wi
Scala - 可变(var)方法参数引用
编辑:我在这里不断获得支持。只是为了记录，我认为这不再重要。自从我发布它以来我就不再需要它了。我想在 Scala 中执行以下操作... def save(srcPath: String, destP
hash - 可变 HashMap 键是一种危险的做法吗？
使用可变对象作为 Hashmap 键是一种不好的做法吗？当您尝试使用已修改足以更改其哈希码的键从 HashMap 中检索值时，会发生什么？例如，给定 class Key { int a; /
kotlin - Kotlin(可变)列表
如果您在Kotlin中访问List类型的Java值，则将获得(Mutable)List!类型。例如。: Java代码: public class Example { public stati
python - 可变 str 类扩展
我编写了 str 类(内置)的以下扩展，以便执行以下操作:假设我有字符串 "Ciao" ，通过做"Ciao" - "a"我想要的结果是字符串 "Cio" 。这是执行此操作的代码，并且运行良好: cla
hash - 可变 HashMap 键是一种危险的做法吗？
使用可变对象作为 Hashmap 键是一种不好的做法吗？当您尝试使用已修改足以更改其哈希码的键从 HashMap 中检索值时，会发生什么？例如，给定 class Key { int a; /
SQL 数据库规范化和外键实践(可变/空白键？)
我正在为我的公司设计一个数据库来管理商业贷款。每笔贷款都可以有担保人，可以是个人或公司，在借款业务失败时作为财务支持。我有 3 个表:Loan、Person 和 Company，它们存储明显的信息。
c# - 可变 F# 记录的二进制序列化
我使用二进制序列化从 C# 类中保存 F# 记录。一切正常: F#: type GameState = { LevelStatus : LevelStatus
java - 对齐系统输出中的双(可变)列
import javax.swing.JOptionPane; public class HW { public static void main(String[] args) { Strin
c++ - 可变 FlatBuffers ，性能损失？
使用 flatbuffer mutable 有多少性能损失？是否“正确”使用 FlatBuffers 来拥有一个应该可编辑的对象/结构(即游戏状态) 在我的示例中，我现在有以下类: class Ga
c++ - 可变 lambda 是否有自己的捕获值拷贝？
std::function create_function (args...) { int x = initial_value (args...); return [x] () mut
C++ - 如何在字符串中查找(可变)字符？
我需要在 for 循环中找到用户输入的字符。我通常会这样做如果(句子[i] == 'e') 但是因为在这里，'e' 将是一个单字母字符变量，我不知道如何获取要比较的值。我不能只输入 if (sent
rust - 可变 Vector 中引用的生命周期
我有一个这样的算法: let seed: Foo = ... let mut stack: Vec = Vec::new(); stack.push(&seed); while let Some(ne
for-loop - 如何循环特定(可变)次数？
这个问题可能看起来非常基础，但我很难弄清楚如何做。我有一个整数，我需要使用 for 循环来循环整数次。首先，我尝试了—— fn main() { let number = 10; // An
rust - 如何解构元组以使绑定(bind)可变？
如果我有以下结构: struct MyStruct { tuple: (i32, i32) }; 以及以下函数: // This will not compile fn function(&mut s
mysql - 可变 SQL 列默认值
我希望在每个 session 的基础上指定列的默认值。下面的脚本不起作用，但描述了我想如何使用它。我目前使用的是 MySQL 5.5.28，但如果需要可以升级。 CREATE TABLE my_tbl

首页

博学

6Ren·AI

商城

python - CNN 中的 Tensorflow 可变动态大小