python - 有没有办法将参数传递给 optuna 中的多个工作？-6ren

python - 有没有办法将参数传递给 optuna 中的多个工作？

转载作者：行者123 更新时间：2023-12-03 13:15:57

25

4

我正在尝试使用 optuna 搜索超参数空间。

在一个特定场景中，我在一台带有几个 GPU 的机器上训练一个模型。模型和批量大小允许我每 1 个 GPU 运行 1 次训练。所以，理想情况下，我想让 optuna 将所有试验分布在可用的 GPU 上这样每个 GPU 上总是运行 1 个试验。

在 docs它说，我应该在一个单独的终端中为每个 GPU 启动一个进程，例如:

CUDA_VISIBLE_DEVICES=0 optuna study optimize foo.py objective --study foo --storage sqlite:///example.db

我想避免这种情况，因为在那之后整个超参数搜索会继续进行多轮。我不想总是手动启动每个 GPU 的进程，检查所有进程何时完成，然后开始下一轮。

我看到 study.optimize 有一个 n_jobs 参数。乍一看，这似乎是完美的。例如我可以这样做:

import optuna

def objective(trial):
    # the actual model would be trained here
    # the trainer here would need to know which GPU
    # it should be using
    best_val_loss = trainer(**trial.params)
    return best_val_loss

study = optuna.create_study()
study.optimize(objective, n_trials=100, n_jobs=8)

这会启动多个线程，每个线程都开始训练。然而，objective 中的训练器不知何故需要知道它应该使用哪个 GPU。有什么诀窍可以做到吗？

最佳答案

经过几次精神崩溃后，我发现我可以使用 multiprocessing.Queue 做我想做的事。要将其纳入目标函数，我需要将其定义为 lambda 函数或类(我猜 partial 也可以)。例如

from contextlib import contextmanager
import multiprocessing
N_GPUS = 2

class GpuQueue:

    def __init__(self):
        self.queue = multiprocessing.Manager().Queue()
        all_idxs = list(range(N_GPUS)) if N_GPUS > 0 else [None]
        for idx in all_idxs:
            self.queue.put(idx)

    @contextmanager
    def one_gpu_per_process(self):
        current_idx = self.queue.get()
        yield current_idx
        self.queue.put(current_idx)


class Objective:

    def __init__(self, gpu_queue: GpuQueue):
        self.gpu_queue = gpu_queue

    def __call__(self, trial: Trial):
        with self.gpu_queue.one_gpu_per_process() as gpu_i:
            best_val_loss = trainer(**trial.params, gpu=gpu_i)
            return best_val_loss

if __name__ == '__main__':
    study = optuna.create_study()
    study.optimize(Objective(GpuQueue()), n_trials=100, n_jobs=8)

关于python - 有没有办法将参数传递给 optuna 中的多个工作？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/61763206/

25

4

0

文章推荐： java - 等到线程完成

文章推荐： java - Java线程坏了

文章推荐： java - 线程java.lang.IllegalStateException异常: Cipher not initialized

文章推荐： java - Java的事前关系？

java - 使用 Parcelable 传递 Arraylist，传递 null
Github:https://github.com/jjvang/PassIntentDemo 我一直在关注有关按 Intent 传递对象的教程:https://www.javacodegeeks.c
c# - 试图让我的文本字段在按下按钮时作为 FormCollection 传递，但 FormCollection 以 null 传递
我有一个 View ，其中包含自动生成的 text 类型的 input 框。当我单击“通过电子邮件发送结果”按钮时，代码会将您带到 CalculatedResults Controller 中的 Em
docker - 传递--env变量现在可以与ENTRYPOINT一起使用
我有一个基本的docker镜像，我将以此为基础构建自己的镜像。我没有基础镜像的Dockerfile。基本上，基本镜像使用两个--env arg，一个接受其许可证，一个选择在容器中激活哪个框架。我可以
f# - 传递 ** 作为参数
假设我想计算 2^n 的总和，n 范围从 0 到 100。我可以编写以下内容: seq { 0 .. 100 } |> Seq.sumBy ((**) 2I) 但是，这与 (*) 或其他运算符/函数不
php 传递 URL
我有这个网址: http://www.example.com/get_url.php?ID=100&Link=http://www.test.com/page.php?l=1&m=7 当我打印 $_G
javascript - 传递 createObjectURL
我想将 window.URL.createObjectURL(file) 创建的地址传递给 dancer.js 但我得到 GET blob:http%3A//localhost/b847c5cd-aa
C++ 传递 typedef
我想知道如何将 typedef 传递给函数。例如: typedef int box[3][3]; box empty, *board[3][3]; 我如何将 board 传递给函数？我
ios - 传递 NSManagedObject
我正在将一些代码从我的 Controller 移动到核心数据应用程序中的模型。我编写了一个方法，该方法为我定期发出的特定获取请求返回 NSManagedObjectID。 + (NSManagedO
javascript - 将类型化数组作为 any[] 传递？
为什么我不能将类型化数组传递到采用 any[] 的函数/构造函数中？ typedArray = new MyType[ ... ]; items = new ko.observableArray(ty
javascript - 传递 "this"作为参数
我是一名新的 Web 开发人员，正在学习 html5 和 javascript。我有一个带有“选项卡”的网页，可以使网页的某些部分消失并重新出现。链接如下: HOME 和 JavaScript 函
c# - 将代码作为参数C#传递
我试图将对函数的引用作为参数传递很难解释我会写一些伪代码示例 (calling function) function(hello()); function(pass) { if this =
c# - 传递 DataTypeEnum
我在尝试调用我正在创建的 C# 项目中的函数时遇到以下错误: System.Runtime.InteropServices.COMException: Operation is not allowed
linux - 传递\*作为参数的参数
使用 ksh。尝试重用当前脚本而不修改它，基本上可以归结为如下内容: `expr 5 $1 $2` 如何将乘法命令 (*) 作为参数 $1 传递？我首先尝试使用“*”，甚至是\*，但没有用。我尝试
Java - 传递 "this"时在对象属性中获取空值
我一直在研究“Play for Java”这本书，这本书非常棒。我对 Java 还是很陌生，但我一直在关注这些示例，我有点卡在第 3 章上了。可以在此处找到代码:Play for Java on Gi
javascript - js中的函数按值或引用复制/传递
我知道 Javascript 中的对象是通过引用复制/传递的。但是函数呢？当我跳到一些令人困惑的地方时，我正在尝试这段代码。这是代码片段: x = function() { console.log(
python - 传递 !, !=, ~, <, > 作为参数
我希望能够像这样传递参数: fn(a>=b) or fn(a!=b) 我在 DjangoORM 和 SQLAlchemy 中看到了这种行为，但我不知道如何实现它。最佳答案 ORM 使用 specia
javascript - 更新依赖会破坏另一个正在使用它的依赖(传递)
在我的 Angular 项目中，我最近将 rxjs 升级到版本 6。现在，来自 npm 的模块(在 node_modules 文件夹内)由于一些破坏性更改而失败(旧的进口不再有效)。我为我的代码调整了
c - 传递 `*` 时命令行参数编号不正确
这个问题在这里已经有了答案: The issue of * in Command line argument (6 个答案) 关闭 3 年前。我正在编写一个关于反向波兰表示法的 C 程序，它通过命
javascript - 传递 $(this) 作为参数？
$(document).ready(function() { function GetDeals() { alert($(this).attr("id")); } $('.filter
perl中子程序中参数的两种引用(传递)方式介绍
下面是一个例子：复制代码代码如下: use strict; #这里是两个数组 my @i =('1','2','3'); my @j =('a','b','c'); &n

首页

博学

6Ren·AI

商城

python - 有没有办法将参数传递给 optuna 中的多个工作？