python - Tensorflow - 来自 tf.train.shuffle

python - Tensorflow - 来自 tf.train.shuffle_batch 的下一批数据

转载作者：太空宇宙更新时间：2023-11-03 15:43:08

26

4

我有一个 tfrecords 文件，我希望从中创建批量数据。我正在使用 tf.train.shuffle_batch() 来创建单个批处理。在我的训练中，我想调用批处理并通过它们。这就是我被困住的地方。我读到，TFRecordReader() 的位置被保存在图形的状态中，并且从后续位置读取下一个示例。问题是我不知道如何加载下一批。我使用下面的代码来创建批处理。

def read_and_decode_single_example(filename):
    filename_queue = tf.train.string_input_producer([filename], num_epochs=1)
    reader = tf.TFRecordReader()
    _, serialized_example = reader.read(filename_queue)
    features = tf.parse_single_example(
        serialized_example,
        features={
            'context': tf.FixedLenFeature([160], tf.int64),
            'context_len': tf.FixedLenFeature([1], tf.int64),
            'utterance': tf.FixedLenFeature([160], tf.int64),
            'utterance_len': tf.FixedLenFeature([1], tf.int64),
            'label': tf.FixedLenFeature([1], tf.int64)
        })

    contexts = features['context']
    context_lens = features['context_len']
    utterances = features['utterance']
    utterance_lens = features['utterance_len']
    labels = features['label']

    return contexts, context_lens, utterances, utterance_lens, labels

contexts, context_lens, utterances, utterance_lens, labels = \
    read_and_decode_single_example('data/train.tfrecords')

contexts_batch, context_lens_batch, \
    utterances_batch, utterance_lens_batch, \
    labels_batch = tf.train.shuffle_batch([contexts, context_lens, utterances,
                                          utterance_lens, labels],
                                          batch_size=batch_size,
                                          capacity=3*batch_size,
                                          min_after_dequeue=batch_size)

这给了我一批数据。我想使用 feed_dict 范例来传递训练批处理，其中每次迭代时都会传入一个新批处理。如何加载这些批处理？调用 read_and_decode 和 tf.train.shuffle_batch 是否会再次调用下一个批处理？

最佳答案

read_and_decode_single_example() 函数为用于加载数据的网络创建一个(子)图；你只调用一次。它可能更合适地称为 build_read_and_decode_single_example_graph()，但这有点长。

“魔力”在于多次评估(即使用)_batch 张量，例如

batch_size = 100
# ...

with tf.Session() as sess:
    # get the first batch of 100 values
    first_batch = sess.run([contexts_batch, context_lens_batch,
                            utterances_batch, utterance_lens_batch,
                            labels_batch])

    # second batch of different 100 values
    second_batch = sess.run([contexts_batch, context_lens_batch,
                            utterances_batch, utterance_lens_batch,
                            labels_batch])
    # etc.

当然，您可以将它们输入到网络的其他部分，而不是手动从 session 中获取这些值。机制是相同的:每当直接或间接获取这些张量之一时，批处理机制将负责每次为您提供一个新批处理(不同值)。

关于python - Tensorflow - 来自 tf.train.shuffle_batch 的下一批数据，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/41978221/

26

4

0

文章推荐： python - 根据其 CA 验证 CRL

文章推荐： python - 如何使用 OpenCV ConnectedComponents 获取图像

文章推荐： Python Selenium xPath 从 div 类 a rel 中选择

python - 什么时候应该使用 tf.train.BytesList、tf.train.FloatList 和 tf.train.Int64List 将数据存储在 tf.train.Feature 中？
TensorFlow 提供了 3 种不同的数据存储格式 tf.train.Feature .它们是: tf.train.BytesList tf.train.FloatList tf.train.In
trains - 使用 Trains 跟踪单独的训练/测试过程
在我的设置中，我运行了一个脚本火车一个模型并开始生成检查点。另一个脚本监视新的检查点和评估他们。脚本并行运行，因此评估只是训练之后的一步。支持这种情况的正确 Tracks 配置是什么？最佳答
trains - Trains 应该如何与 RayTune 等超参数优化工具一起使用？
什么是合理的设置？我可以在同一次执行中多次调用 Task.init() 吗？最佳答案免责声明:我是 allegro.ai Trains 团队的一员一种解决方案是从 trains.automati
trains - ClearML(以前称为 Trains)可以在本地服务器上工作吗？
我想开始我的方式 ClearML (以前称为火车)。我在documentation上看到的我需要在 ClearML 平台本身或使用 AWS 等的远程机器上运行服务器。我真的很想绕过这个限制并在我的
machine-learning - WEKA的多层感知器: training then training again
我正在尝试使用 weka 的 MultilayerPerceptron 执行以下操作: 使用一小部分训练实例来训练一部分历元输入，在剩余的周期中使用整组实例进行训练。但是，当我在代码中执行以下操作
c++ - 对象检测 : Training Requried or No Training Required?
这个问题与对象检测有关，基本上是检测任何“已知”对象。例如，假设我有以下对象。表格瓶子。相机汽车我将从所有这些单独的对象中拍摄 4 张照片。左边一个，右边一个，上下两个。我本来以为用这4张照
"RuntimeError: You must train on the training inputs! " When I'm trying to use mini batch in training Guassian Process Regression Model(“RuntimeError：你必须在训练输入上训练！which is the most important part of the Process Regression Model.“)
我已经编写了一段代码来训练Guassian过程回归模型来预测年龄。我已经编写了以下代码，并且运行良好：。但我注意到，每个纪元都输入了相同的数据，我认为这可能会导致过度拟合，所以我想使用Mini Bat
浅谈tf.train.Saver()与tf.train.import_meta_graph的要点
(一)、tf.train.Saver() (1). tf.train.Saver() 是用来保存tensorflow训练模型的，默认保存全部参数 (2). 用来加载参数，注：只加载存储在data
python - Pytorch model.train() 和教程中编写的单独的 train() 函数
我是 PyTorch 的新手，我想知道您是否可以向我解释 PyTorch 中的默认 model.train() 与此处的 train() 函数之间的一些关键区别。另一个 train() 函数位于关于
Training on a pre-trained model with new classes(使用新课程对预先训练好的模型进行培训)
我可以在maskrcnn的预训练模型的基础上训练吗？如果预训练模型的类别与我自己的数据集不同，预训练模型仍然有效吗？。我尝试了一个新的班级训练数据集。但它似乎收敛得非常慢。
Training on a pre-trained model with new classes(使用新课程对预先训练好的模型进行培训)
我可以按照Maskrcnn预先训练的模式进行训练吗？如果预先训练的模型的类别与我自己的数据集的类别不同，那么预先训练的模型是否仍然有效？。我尝试了一个新的班级训练数据集。但它似乎收敛得非常慢。
tensorflow - tf.train.MonitoredTrainingSession 和 tf.train.Supervisor 有什么区别
我想知道这两个 tensorflow 对象在用于训练神经网络时有什么区别？最佳答案 Supervisor 即将被弃用，鼓励新用户使用 tf.train.FooSession 类 (来自 commen
python - tf.train.ExponentialMovingAverage 和 tf.train.MomentumOptimizer 有什么区别？
我已经看到文档 tf.train.ExponentialMovingAverage 实现了这个公式: shadow_variable = decay * shadow_variable + (1 -
python - tf.train.Checkpoint 和 tf.train.Saver 之间的区别
我发现在 Tensorflow 中有不同的方法来保存/恢复模型和变量。这些方式包括: tf.saved_model.simple_save tf.train.Checkpoint tf.train.S
python - tf.train.shuffle_batch_join 和 tf.train.shuffle_batch 之间的区别
查看两个带有参数的函数签名 tf.train.shuffle_batch_join( tensors_list, batch_size, capacity, min_after_dequeue, se
python - tf.train.shuffle_batch 和 `tf.train.batch 发生了什么？
我使用 Binary data训练 DNN。但是 tf.train.shuffle_batch 和 tf.train.batch 让我很困惑。这是我的代码，我将对其进行一些测试。首先Using_
machine-learning - SageMaker Estimator.fit() 未将 'train' 输入传递给 Training 实例
正如文档/教程中提到的，我们可以调用 Estimator.fit()开始训练工作。该方法所需的参数为 inputs这是对训练文件的 s3/file 引用。示例: estimator.fit({'tr
python - key 错误 : "Invalid split train[:80%]. Available splits are: [' train']"
这个问题在这里已经有了答案: Split train data to train and validation by using tensorflow_datasets.load (TF 2.1) (
multithreading - tf.train.Coordinator 类和 tf.train.QueueRunner 类在 tensorflow 中做什么？
我知道这两个类都处理线程。根据文档，tf.train.Coordinator 协调一组线程的终止，而 tf.train.QueueRunner 保存队列的入队操作列表，每个操作都在一个线程中运行。但
tensorflow - 对于可变长度特征，使用 tf.train.SequenceExample 相对于 tf.train.Example 有何优点？
最近我读了this TensorFlow 中未记录特征的指南，因为我需要传递可变长度序列作为输入。但是，我发现 tf.train.SequenceExample 的协议(protocol)相对困惑(特

首页

博学

6Ren·AI

商城

python - Tensorflow - 来自 tf.train.shuffle_batch 的下一批数据