keras - 对 keras 点层感到困惑。点积是如何计算的？-6ren

keras - 对 keras 点层感到困惑。点积是如何计算的？

转载作者：行者123 更新时间：2023-12-04 04:20:28

25

4

我阅读了所有关于 Dot Layer 的文章，但没有一篇解释如何计算输出形状!虽然看起来很标准!使用 a 沿特定轴计算的值究竟是如何计算的？

val = np.random.randint(2, size=(2, 3, 4))
a = K.variable(value=val)
val2 = np.random.randint(2, size=(2, 2, 3))
b = K.variable(value=val)
print("a")
print(val)
print("b")
print(val2)
out = Dot(axes = 2)([a,b])
print(out.shape)
print("DOT")
print(K.eval(out))

我得到:

a
[[[0 1 1 1]
  [1 1 0 0]
  [0 0 1 1]]

 [[1 1 1 0]
  [0 0 1 0]
  [0 1 0 0]]]
b
[[[1 0 1]
  [1 0 1]]

 [[1 0 1]
  [1 1 0]]]
(2, 3, 3)
DOT
[[[ 3.  1.  2.]
  [ 1.  2.  0.]
  [ 2.  0.  2.]]

 [[ 3.  1.  1.]
  [ 1.  1.  0.]
  [ 1.  0.  1.]]]

我无法理解我的数学和代数矩阵知识是如何计算的？

最佳答案

Dot 产品的工作原理如下。它在内部调用 K.batch_dot .

首先，我认为您可能打算这样做，

val = np.random.randint(2, size=(2, 3, 4))
a = K.variable(value=val)
val2 = np.random.randint(2, size=(2, 2, 3))
b = K.variable(value=val2) # You have val here

但幸运的是，你已经(或者也可能是你的初衷。无论如何只是指出)

b = K.variable(value=val)

如果您有预期的代码，它会抛出一个错误，因为您想要点积的维度不匹配。继续前进，

如何计算点积

你有

a.shape = (2,3,4)
b.shape = (2,3,4)

首先，您仅在批量维度上执行逐元素点。所以那个维度保持那样。

现在您可以忽略 a 和 b 的第一维，并考虑两个矩阵 (3,4) 和(3,4) 并在最后一个轴上进行点积，从而生成 (3,3) 矩阵。现在添加您获得的批量维度，

(2, 3, 3) tensor

现在让我们举个例子。你有，

a
[[[0 1 1 1]
  [1 1 0 0]
  [0 0 1 1]]

 [[1 1 1 0]
  [0 0 1 0]
  [0 1 0 0]]]

b
[[[0 1 1 1]
  [1 1 0 0]
  [0 0 1 1]]

 [[1 1 1 0]
  [0 0 1 0]
  [0 1 0 0]]]

然后你做以下两个点积。

# 1st sample
[0 1 1 1] . [0 1 1 1]
[1 1 0 0] . [1 1 0 0]
[0 0 1 1] . [0 0 1 1]

# 2nd sample
[1 1 1 0] . [1 1 1 0]
[0 0 1 0] . [0 0 1 0]
[0 1 0 0] . [0 1 0 0]

这给出了，

# 1st sample
[3 1 2]
[1 2 0]
[2 0 2]

# 2nd sample
[ 3 1 1]
[ 1 1 0]
[ 1 0 1]

最后添加缺失的批处理维度，

[[[ 3.  1.  2.]
  [ 1.  2.  0.]
  [ 2.  0.  2.]]

 [[ 3.  1.  1.]
  [ 1.  1.  0.]
  [ 1.  0.  1.]]]

关于keras - 对 keras 点层感到困惑。点积是如何计算的？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/59502733/

25

4

0

文章推荐： python - 如何构建 Flask + Reactjs 项目

文章推荐： r - 无法安装 gdtools 或 svglite

文章推荐： tensorflow - 不能将 GPU 与 Pytorch 一起使用

Java重绘()困惑
我有一个程序可以打开一个窗口并快速改变背景颜色并随机弹出矩形和椭圆形。我的代码有效，但我不知道为什么，因为我没有在我的代码中调用 repaint() 函数。当我使用我个人的 update() 函数包含
Javascript 困惑
var allRapidSpells = $$('input[value^=RSW]'); 谁能告诉我这是做什么的？最佳答案我敢猜测您正在使用 MooTools ，一个 JavaScript 框架
Java继承...困惑
我有一个抽象父类，它有多个子类。我希望 child 能够拥有一个对于该 child 的每个实例都相同的变量。我不想将构造函数传递给 child 来告诉它它的名字，因为当它可以被硬编码时，这看起来很愚蠢
困惑!提交到错误的分支
我刚刚在 Git 存储库上做了一些糟糕的事情，我不知道如何解决这个问题。我什至不知道我是怎么把它弄成这样的……! 在存储库(托管在 git hub 上)上，有 3 个我感兴趣的分支:master、br
Git 提交日志图 - 困惑
我是 GIT 的新手，在理解提交日志图时遇到问题。我感觉每条平行线都是一个分支。虽然我的源代码只有 2 个分支。我在下面提供的提交日志图中看到 3-4 条平行线(Microsoft Team Ser
WPF - ScrollView 困惑
我是 WPF 的新手，ScrollViewer 让我很沮丧。要么我只是没有“得到”它，要么它是一种有限的控制。这是我的挫折: 水平滚动错误水平滚动条仅在列表底部可见(我必须滚动到底部才能看到) 坏
jQuery 类选择器性能(困惑)
那么 $('table.selectable td.capable input:text') 比 $('table.selectable td input:text') 更好吗？换句话说，指定一个类会
c - 在优化中迷失/困惑
我刚刚完成了计算机图形学类(class)，我们必须对光线追踪器进行编程。尽管所有结果都是正确的，但我对 OpenMP 的使用感到困惑(顺便说一句，这不是类(class)的一部分)。我有这个循环(C++
haskell - 模式同义词作为函数的无趣/困惑
与 PatternSynonyms ( explicitly bidirectional form )，pattern-to-expr 方程实际上形成了一个函数，但拼写为大写(假设您最终得到正确类型的
javascript setTimeout 困惑
我是 javascript/coffeescript 新手。有人可以解释一下为什么这个 CoffeeScript/JavaScript 会毫无延迟地快速通过吗？我对第一种情况的想法是，它是对 upd
javascript - HTMLCollection 困惑
如果我调用document.getElementsByClassName('cl')，我会得到一个 HTMLCollection。它似乎包含 Element 对象而不是 HTMLElement 对象，
Azure 使用成本 - 困惑
这是我本月的 azure payasyougo 使用费用。我很难理解为什么我要为标准中型应用服务付费，我认为它会包含在计算时间中？我只运行一个云服务，这对于一个没有做太多事情的云服务来说似乎有点陡峭
hadoop - Zookeeper启动问题/困惑
除了the issue I am already having之外，我还在I saw a video on it之后安装了HBase(尚未安装)之前，还安装了Zookeeper。在安装它时，我遇到了许
JavaScript 正则表达式模式 - 困惑
我正在将 XSLT 与 regexp:match exslt 函数一起使用。上述函数采用 JavaScript Regex 模式。因此，我尝试匹配一组数字 1 到 3 OR 5 到 7 OR 9 到
javascript - 代码学院错误(困惑)^^
我想知道为什么这段代码会给出消息:SyntaxError:意外的标记其他。 var compare = function(choice1,choice2){ if(choice1===choice2)
javascript - jQuery 困惑
我尝试使用复选框和 JQuery 过滤日历上的事件， $(document).ready(function () { $('.scrollable-menu :checkbox').click(f
java - 创建文件而不根据用户输入创建新文件夹[困惑]
假设我们有一个用户想要一个名为:“test/lasdhjal.txt”，无论如何。现在，如果我将其放入新的文件(输入)中；对象里面，它会认为 test/是一个文件夹，而它是名称的一部分。我能做什么呢？
Git stash 困惑
问题是 stash 的更改不会留在我 stash 它们的分支中。其他分支存储将被覆盖示例: 我愿意: git checkout iss4 // made some changes gi
java - StackOverflow 困惑
我是一个 java 新手，并且在 StackOverflow 错误/在类之间访问文件的能力方面遇到了一个非常令人困惑的问题。我知道根本原因可能是我进行了一些递归调用，但修复它的语法却让我无法理解。我认
java - 泛型 - 困惑
public X createData(int n) { int[] values = new int[n]; Random rand = new Random(); for

首页

博学

6Ren·AI

商城

keras - 对 keras 点层感到困惑。点积是如何计算的？

如何计算点积