theano - 加载小批量的有效方法

theano - 加载小批量的有效方法 < GPU 内存

转载作者：行者123 更新时间：2023-12-01 23:15:43

26

4

我有以下情况:

我的数据集 >> GPU 内存
我的小批量 < GPU 内存...这样，根据大小，我可以一次在内存中容纳最多 10 个小批量，同时仍然可以毫无问题地进行训练。

我的数据集的大小意味着我不会重新访问数据点，所以我想共享它们没有意义？或者有吗？我在想，也许拥有最多 10 个 size=mini-batch 的共享初始化变量会很有好处，这样我就可以一次交换 10 个变量，而不是一次只交换一个变量。另外，是否可以并行预加载小批量？

最佳答案

如果您不重新访问数据点，那么使用共享变量可能没有任何值(value)。

可以修改以下代码并用于评估将数据获取到特定计算中的不同方法。

当您不需要重新访问数据时，“输入”方法可能是最好的方法。 “shared_all”方法可能会优于其他方法，但前提是您可以将整个数据集放入 GPU 内存中。 “shared_batched”允许您评估分层批处理数据是否有帮助。

在“shared_batched”方法中，数据集被分为许多宏批处理，每个宏批处理又被分为许多微批处理。单个共享变量用于保存单个宏批处理。该代码评估当前宏批处理中的所有微批处理。一旦处理完一个完整的宏批处理，下一个宏批处理就会加载到共享变量中，并且代码会再次迭代其中的微批处理。

一般来说，可以预期少量的大内存传输会比大量的小传输运行得更快(其中每个传输的总传输量是相同的)。但这需要经过测试(例如使用下面的代码)才能确定； YMMV。

使用“借用”参数也可能对性能产生重大影响，但要注意the implications使用前。

import math
import timeit
import numpy
import theano
import theano.tensor as tt


def test_input(data, batch_size):
    assert data.shape[0] % batch_size == 0
    batch_count = data.shape[0] / batch_size
    x = tt.tensor4()
    f = theano.function([x], outputs=x.sum())
    total = 0.
    start = timeit.default_timer()
    for batch_index in xrange(batch_count):
        total += f(data[batch_index * batch_size: (batch_index + 1) * batch_size])
    print 'IN\tNA\t%s\t%s\t%s\t%s' % (batch_size, batch_size, timeit.default_timer() - start, total)


def test_shared_all(data, batch_size):
    batch_count = data.shape[0] / batch_size
    for borrow in (True, False):
        start = timeit.default_timer()
        all = theano.shared(data, borrow=borrow)
        load_time = timeit.default_timer() - start
        x = tt.tensor4()
        i = tt.lscalar()
        f = theano.function([i], outputs=x.sum(), givens={x: all[i * batch_size:(i + 1) * batch_size]})
        total = 0.
        start = timeit.default_timer()
        for batch_index in xrange(batch_count):
            total += f(batch_index)
        print 'SA\t%s\t%s\t%s\t%s\t%s' % (
            borrow, batch_size, batch_size, load_time + timeit.default_timer() - start, total)


def test_shared_batched(data, macro_batch_size, micro_batch_size):
    assert data.shape[0] % macro_batch_size == 0
    assert macro_batch_size % micro_batch_size == 0
    macro_batch_count = data.shape[0] / macro_batch_size
    micro_batch_count = macro_batch_size / micro_batch_size
    macro_batch = theano.shared(numpy.empty((macro_batch_size,) + data.shape[1:], dtype=theano.config.floatX),
                                borrow=True)
    x = tt.tensor4()
    i = tt.lscalar()
    f = theano.function([i], outputs=x.sum(), givens={x: macro_batch[i * micro_batch_size:(i + 1) * micro_batch_size]})
    for borrow in (True, False):
        total = 0.
        start = timeit.default_timer()
        for macro_batch_index in xrange(macro_batch_count):
            macro_batch.set_value(
                data[macro_batch_index * macro_batch_size: (macro_batch_index + 1) * macro_batch_size], borrow=borrow)
            for micro_batch_index in xrange(micro_batch_count):
                total += f(micro_batch_index)
        print 'SB\t%s\t%s\t%s\t%s\t%s' % (
            borrow, macro_batch_size, micro_batch_size, timeit.default_timer() - start, total)


def main():
    numpy.random.seed(1)

    shape = (20000, 3, 32, 32)

    print 'Creating random data with shape', shape
    data = numpy.random.standard_normal(size=shape).astype(theano.config.floatX)

    print 'Running tests'
    for macro_batch_size in (shape[0] / pow(10, i) for i in xrange(int(math.log(shape[0], 10)))):
        test_shared_all(data, macro_batch_size)
        test_input(data, macro_batch_size)
        for micro_batch_size in (macro_batch_size / pow(10, i) for i in
                                 xrange(int(math.log(macro_batch_size, 10)) + 1)):
            test_shared_batched(data, macro_batch_size, micro_batch_size)


main()

关于theano - 加载小批量的有效方法 < GPU 内存，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/33248959/

26

4

0

文章推荐： java - Pattern.compile 包含特殊字符的字符串

文章推荐： crontab - cloud9.ide有时间限制吗？

文章推荐： angular - 使用 canLoad 预加载惰性路由

文章推荐： image - Emacs:是否可以浏览目录中的图像？在 Windows 上？

java - JPA/Hibernate 批量(批量)插入
这是我在阅读了几个关于 jpa 批量插入的主题后创建的简单示例，我有 2 个持久对象用户和站点。一个用户可以有多个站点，所以我们在这里有一对多的关系。假设我想创建用户并将多个站点创建/链接到用户帐户。
azure - 如何在文档数据库中上传多个文档(批量)
我有文档列表(对象)，该对象有多个文档，即存在 Json 记录，但是当我尝试上传文档束(记录)时，它没有上传到文档数据库，但当我上传单个文档记录时，它上传成功。 List listObj = ne
perl - 如何检查域名是否可用(批量)？
我希望进行批量域名查找，看看是否有一些域名可供购买。我找不到 perl 模块，但似乎应该有一种方法可以在 perl 中执行此操作。我正在寻找免费的东西。谢谢! 最佳答案从这里:http://www.
axapta - 批量 FTPWebRequest
我制作了一个批处理类来检查 FTP 上的文件、下载它们并在 FTP 上删除它们。当我手动运行它(不是批量运行)时，它运行完美，下载 FTP 中的所有文件并在下载完成后删除它们。当我尝试批量运行时，
string - 批量 * 通配符替换
我有一个 *+* 形式的字符串 base。我想得到+之前的所有内容。例如，如果 base=foo+bar，我想获取 foo。我尝试过使用字符串替换来实现 set left=%base:+*=% 但这
mysql - 如何使MySQL默认引擎为innodb？(批量)
我需要创建几十个表，并且我需要它们是innodb，有没有办法做到这一点，而不是将 engine=innodb 附加到每个 create table 语句？最佳答案可以在服务器级别指定默认引擎，在
linux - 如何在windows中获取unix风格的提示符(批量)
我正在尝试制作显示 unix/linux 提示符的 dos shell。代码是: @echo off :hi set tmpdrv=%cd:~0,2% if %homedrive% == %tmpdr
matlab - 批量/并行进行一维卷积
我有以下代码，基本上是在二维矩阵的每一行上进行一维卷积。卷积核是一样的。所以真的是 SIMD 案例。 a = [ 1,2,3,4,5; 6,7,8,9,7; 7,6
windows - 如何通过文件夹循环移动文件夹(批量)？
情况: 我尝试在 shell 中的循环内移动文件，但我的代码无法正常工作。 for /D %%F in (*) do ( if "%%F" NEQ "%directoryToPutFilesIn
windows - 批量 |回显多个变量到文件
目录包含 2 个(或更多)任意名称的视频文件。 video1.mkv video2.mkv 需要找出每个视频的持续时间。为此，我们使用 MediaInfo . setlocal EnableDelay
windows - 如何从文件名中删除空格(批量)
如何在 Windows 中批量删除数千个文件中的空格(而不是替换为下划线)？我可以从 DOS 命令执行此操作吗？目前: file one.mp3 file two.mp3 所有文件需要变成: fil
windows - 批量 IF 变量比较神秘地不起作用
我想创建一个批处理文件，它读取 2 个不同的值，并根据它们的比较方式进行相应处理。但是，比较永远不会起作用。代码是: REM string1 and string2 contain the follo
windows - 批量 - 使用通配符将文件夹复制到多个文件夹
我正在尝试将一个文件夹的子文件夹复制到许多其他名称未知的文件夹中。目的是在所有使用它的员工文件夹中备份程序的源文件。如果在员工文件夹中找不到程序文件夹，则不应执行任何操作。这看起来如下: 来源: F:
python - 检测文本是否为英文(批量)
我正在寻找一种简单的方法来检测一小段文本(几句话)是否为英语。在我看来，这个问题比尝试检测任意语言要容易得多。有没有可以做到这一点的软件？我正在用 python 编写，并且更喜欢 python 库，但
android - 批量 Firebase 云消息传递的限制
我们正在尝试向 8k 种不同的设备发送促销推送消息。我们正在成功响应推送通知 URL https://fcm.googleapis.com/fcm/send 但只有部分用户收到此通知，并非全部。那么
batch-file - 批量，用延迟扩展参数替换延迟扩展字符串
基本上我只是用这一段来替换我的 var 中的一个字符串，但我无法让嵌套延迟扩展正常工作。这甚至可能吗？ set replace=!replace:!search!=!replaceVal!! 我知道执
bash - FFmpeg:一次编码多个视频文件(批量)
如何使用 ffmpeg 对一批视频文件进行编码，使用相同的设置？我找到了 one-line solution将当前文件夹中的 .avi 文件转换为 .mov。请注意，我要编码 .mov -> .mo
batch-file - "Counter"批量
我正在尝试制作一个批处理文件，每次循环时都会将变量增加 1，然后检查变量是否等于 5，如果不是，则再次循环。我知道这可能有一个 while 循环，但我不知道如何做到这一点，我现在只是享受学习 Batc
读取带有变量行的 CSV 以跳过、批量
我正在尝试创建一个循环，读取多个 CSV 文件，这些文件都具有相同类型的气温数据。但是，我想跳过数据上方的行。这些是数据集中的“警报”。每个文件可能有不同数量的警报，因此要跳过不同数量的行。见下文:
batch-file - 在文件中回显多个单词会使它崩溃。 (批量)
因此，我正在批量创建一个Mail程序，而消息传递部分出现了问题。消息传递部分是无限循环。当我输入多个单词时，它会崩溃。这是代码。请帮忙! :rep set line= set /p line=

首页

博学

6Ren·AI

商城

theano - 加载小批量的有效方法 < GPU 内存