python - 将函数应用于 3D 张量，同时忽略零行和填充-6ren

python - 将函数应用于 3D 张量，同时忽略零行和填充

转载作者：行者123 更新时间：2023-12-01 09:26:24

26

4

我目前正在尝试改善我的 tensorflow 管道中最昂贵的操作的运行时间。

我正在尝试完成以下任务:给我一个 3D 张量，其中包含一些患者数据的多个样本，例如数据可能如下所示

n_hidden = 3  #number of elements per 1D tensor
batch_size = 3 #number of patients
n_mc_samples = 2 #number of samples per patient
rnn_grid_times = [2,3,1] #number of non zero 1D tensors per patient
all_outputs = tf.constant([[[0.15, 0.874, 0.2], [0.1,0.00878,0.58],[0.0,0.0,0.0]], #beginning of patient 1
                               [[0.456,0.454,0.003],[0.4564,0.4984,0.21], [0.0,0.0,0.0]],
                               [[0.121,0.22,0.45],[0.15,0.488,0.222], [0.11,0.849,0.45]],  #beginning of patient 2
                               [[0.15, 0.5646, 0.15], [0.45,0.48949,0.56465], [0.4489,0.456,0.9]],
                               [[0.121, 0.22, 0.01], [0.0, 0.0, 0.0], [0.0, 0.0, 0.0]], #beginning of patient 3
                               [[0.15, 0.89, 0.42], [0.0, 0.0, 0.0], [0.0, 0.0, 0.0]]])

该数据对应3名患者，每个患者采样两次。正如您所看到的，患者 1 和 3 的数据被填充为与患者 2 的数据大小相同。

我的目标是将每个非零一维张量馈送到具有一个隐藏层的单个输出神经网络，然后在零张量的位置添加额外的pedding，以保持患者之间的统一维度。所以这里的有效结果可能是

[[-0.11379365, -0.11188659,  0.        ],
 [-0.11379365, -0.11379365,  0.        ],
 [-0.1135166 , -0.11379365, -0.11379365],
 [-0.11379365, -0.11359671, -0.11270589],
 [-0.11379365,  0.        ,  0.        ],
 [-0.11379365,  0.        ,  0.        ]]

重申一下，因为我意识到这有点复杂，第一个代码块中与 [0.15, 0.874, 0.2] 关联的输出是 -0.11379365在第二个代码块中。

这是独立的代码，上面显示了玩具数据。如果您有工作 tensorflow 环境，这应该可以毫无问题地运行

import tensorflow as tf    
RANDOM_SEED = 42
tf.set_random_seed(RANDOM_SEED)

def code():
    n_hidden = 3
    batch_size = 3
    n_mc_samples = 2
    num_rnn_grid_times = tf.constant([2, 3, 1])
    all_outputs = tf.constant([[[0.15, 0.874, 0.2], [0.1,0.00878,0.58],[0.0,0.0,0.0]], #beginning of patient 1
                               [[0.456,0.454,0.003],[0.4564,0.4984,0.21], [0.0,0.0,0.0]],
                               [[0.121,0.22,0.45],[0.15,0.488,0.222], [0.11,0.849,0.45]],  #beginning of patient 2
                               [[0.15, 0.5646, 0.15], [0.45,0.48949,0.56465], [0.4489,0.456,0.9]],
                               [[0.121, 0.22, 0.01], [0.0, 0.0, 0.0], [0.0, 0.0, 0.0]], #beginning of patient 3
                               [[0.15, 0.89, 0.42], [0.0, 0.0, 0.0], [0.0, 0.0, 0.0]]])


    n_extra_hidden_nodes = 2
    extra_hidden_weights = tf.Variable(tf.random_normal([n_hidden, n_extra_hidden_nodes], stddev=0.1), name="HiddenSoftmax/W")
    extra_hidden_biases = tf.Variable(tf.random_normal([n_extra_hidden_nodes], stddev=0.1), name="HiddenSoftmax/b")


    out_weights = tf.Variable(tf.random_normal([n_extra_hidden_nodes, 1], stddev=0.1), name="Softmax/W") 
    out_biases = tf.Variable(tf.random_normal([1], stddev=0.1), name="Softmax/b")



    nneth_array_total = tf.Variable([])
    n = tf.constant(0)
    inner_cond = lambda i, nneth_array, n: tf.less(i, num_rnn_grid_times[tf.floordiv(n,n_mc_samples)])
    cond = lambda n, nneth_array_total: tf.less(n, batch_size*n_mc_samples)

    def inner_body(i, nneth_array, n):
        hidden = tf.nn.relu(tf.matmul(tf.expand_dims(all_outputs[n][i], 0), extra_hidden_weights) + extra_hidden_biases)
        nneth = tf.matmul(hidden, out_weights) + out_biases
        nneth = tf.reshape(nneth, [1]) #single output for the neural net
        nneth_array = tf.concat([nneth_array, nneth], 0)
        return i + 1, nneth_array, n

    def body(n, nneth_array_total):
        nneth_array = tf.Variable([])
        i = tf.constant(0) #iterator over 1D tensors
        i, nneth_array, n = tf.while_loop(inner_cond, inner_body, loop_vars=[i, nneth_array, n], shape_invariants=[i.get_shape(), tf.TensorShape([None]), n.get_shape()])
        padding = tf.zeros([tf.reduce_max(num_rnn_grid_times) - num_rnn_grid_times[tf.floordiv(n,n_mc_samples)]],dtype=tf.float32)
        nneth_array = tf.concat([nneth_array, padding],0) #add extra zeros so that all nneth_arrays have same shape
        nneth_array_total= tf.concat([nneth_array_total, nneth_array], 0)
        return n+1, nneth_array_total


    n, nneth_array_total = tf.while_loop(cond, body, loop_vars=[n, nneth_array_total],
                                         shape_invariants=[n.get_shape(), tf.TensorShape([None])])

    nneth_array_total = tf.reshape(nneth_array_total, [batch_size*n_mc_samples, tf.reduce_max(num_rnn_grid_times)])

    preds = nneth_array_total
    return preds



if __name__ == '__main__':
    pred = code()
    init = tf.global_variables_initializer()
    sess = tf.Session()
    sess.run(init)



    sess.run(init)
    print(sess.run([pred]))

代码可以工作，但是速度很慢。这是管道的一部分，迭代一名患者大约需要 1.25 秒，而且似乎大部分运行时间都是由于上面的代码造成的。这意味着我的数据集的一个 epoch 大约需要 12 小时，与类似的方法相比，这有点太多了。

我用谷歌搜索并找到了将函数应用于多维张量的方法，但没有一个也考虑到填充。有什么见解吗？

最佳答案

即使使用零向量馈送整个输入也能提供最快的处理时间。但正如您所说，由于网络中的偏差，这将返回非零输出。由于当输入向量需要为零时，您希望输出为零，因此一个简单的技巧是应用一个掩码，如果输入向量为零，则该掩码将使预测为零。

当输入向量非零时返回 1，否则返回 0 的掩码可以通过简单的逻辑获得:

a_sum = tf.reduce_sum(all_outputs, 2)

mask = tf.cast(tf.greater(a_sum, tf.zeros_like(a_sum)), tf.float32)

然后将预测与掩码相乘。

关于python - 将函数应用于 3D 张量，同时忽略零行和填充，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/50352542/

26

4

0

文章推荐： java - 仅在满足条件时打印 hello world

文章推荐： regex - 帮助解决一组中缺乏值(value)的正则表达式模式

文章推荐： python - python 将字符串转换为 float

r - 应用于 3 个变量的数据框转换
我写了几个命令来转换数据框，但我想将我写的代码简化为四个部分。第 1,2 和 3 部分用于计算第 1、2 和 3 列(计算每列重复值的次数，并完成 0 和三列最大值之间的缺失数)。第四部分是加入前面的
scala - 应用于 Scala 函数的类型参数
我试图理解应用于函数的类型参数。我想在下面的方法中使用通用类型，但为了我的理解使用 String 和 Int。当我如下定义一个函数时 def myfunc[Int](f:String => I
应用于 DIV 内容的 CSS
我有一个像下面这样的 DIV: // link to some js .js 在 div 中呈现最新的文章摘要。然而，它在 Calibri
gridview - 应用于 gridview 中的边界字段的格式不起作用
我在 GridView 中有以下列，一列是日期，另一列是美元金额。我应用了格式并将 HtmlEncode 属性设置为 false，但值仍然未格式化: 这就是这些值在 GridView 中的显示方式
haskell - 应用于 Haskell 中标记类型的通用函数
假设我已经定义了这些类型: data Km = Km Float deriving (Show, Eq) data Mile = Mile Float deriving (Show, Eq
haskell - 关于上下文中的值(应用于 Monad)
我有一个关于 value in context 的小问题。取 Just 'a'，所以在这种情况下 Maybe 类型上下文中的值是 'a' 采用[3]，因此在这种情况下，[a] 类型上下文中的值为3
rollapply 应用于 xts 对象
require(quantmod) require(PerformanceAnalytics) getSymbols('INTC') x<- monthlyReturn(INTC) rollapply
vba - 应用于 Word 修订版的更改使两个段落合二为一
我正在使用 VBA 对“已应用字轨更改”文档进行更改。红色段落结束标记是插入段落结束标记。(打开“跟踪更改”> 将光标放在第一段末尾 > 按 Enter > 插入新段落内容 > 格式风格不同) 我需
c++ - 应用于 const 和非常量对象的引用返回方法
考虑以下代码: class A{ my_method(const B& b){ import_something_from_c(this, b.getC()); // does some
ios - 应用于 Material 时像素化图像纹理
我正在为自定义 Material 分配图像。分配的图像看起来有点像素化，类似于此图像我已经将抗锯齿设置为 4 倍。我该如何解决这个问题？最佳答案尝试将 Material 的 mipFilter
css - 应用于 HTML 元素的样式总是被覆盖
我将样式应用于元素和元素。是否可以在上使用样式元素应用于似乎不遵循 CSS 特异性的通常规则。这是真的吗？示例:http://jsfiddle.net/59dpy/ 尝试将所有背景色设为红
html - 应用于 TD 时垂直虚线边框不均匀
有没有办法将垂直虚线边框应用于没有他们(边界)合并？我说的是附图上的东西——有 3 个这里的元素，每个元素包含 2 的。如果我申请 border-right: 1px dashed black到
html - 应用于 body 时线性渐变不起作用
当我在 CSS 中对主体应用线性渐变时，如下所示 body { background: linear-gradient(#10416b, black); } 它不会将它应用到整个网页，而是将它应用到页
css - 应用于 td 的边界半径没有内半径
当我将边框和边框半径应用于 td 时，内半径是一个直 Angular ，根本不是圆的。最佳答案问题很可能是背景不透明的子元素会剪掉边框的内半径。要解决此问题，您可以在 td 上应用 overfl
CSS 应用于 SVG 组元素但不在使用时
基本上，我有一个小的 SVG，它使用一个组来定义一个可重用的符号。该组包括我想在 CSS 中设置动画的路径。我面临的问题是只有“原始”元素应用了 CSS，“使用过”的元素没有。 .player_arr
html - 应用于 td 的宽度属性
宽度属性在这里不起作用: td { height: 50px; width: 25px; border: 1px
Java:应用于 Map 泛型类型的多态性
我想要一个函数(例如)在两种情况下输出 Map 的所有值: Map map1 = new HashMap(); Map map2 = new HashMap(); output(map1, "1234
java - 应用于 AlertDialog 的样式无法正常工作
我被要求将我们应用中的警报对话框的外观与应用主题使用的外观相匹配。我设法将样式应用于应用程序中的所有警报对话框，并将其用作应用程序主题的一部分，但有些情况下样式应用不正确。例如，当警报对话框包含“
ios - 应用于 CGPath 的比例变换会影响渲染质量吗？
我有一个 CGPath(由 UIBezierPath 创建)，我想通过应用 CGAffineTransformScale 将其缩放到我想要的任何大小。这会影响我的绘图质量(在转换为图像时)吗？如果不
c++:应用于 vector 的STL算法也适用于其他容器对象吗？
您好，我已经在 vector 上使用了一些 STL 算法，例如 find_if、count_if、sort、push_back 等。现在我想为所有容器对象( vector 、列表、映射、集合)制作一个

首页

博学

6Ren·AI

商城

python - 将函数应用于 3D 张量，同时忽略零行和填充