gpt4 book ai didi

linux - 在 Ubuntu 16.04 上模拟 SLURM

转载 作者:太空宇宙 更新时间:2023-11-04 09:16:32 24 4
gpt4 key购买 nike

我想在 Ubuntu 16.04 上模拟 SLURM。我不需要认真的资源管理,我只是想测试一些简单的例子。我 cannot install SLURM in the usual way ,我想知道是否还有其他选择。我尝试过的其他事情:

  • A Docker image .不幸的是,docker pull agaveapi/slurm; docker run agaveapi/slurm 给我错误:

    /usr/lib/python2.6/site-packages/supervisor/options.py:295: UserWarning: Supervisord 正在以 root 身份运行,它正在默认位置(包括其当前工作目录)中搜索其配置文件;您可能希望指定一个“-c”参数来指定配置文件的绝对路径以提高安全性。 'Supervisord 以 root 用户身份运行并且正在搜索'2017-10-29 15:27:45,436 CRIT Supervisor 以 root 身份运行(配置文件中没有用户)2017-10-29 15:27:45,437 INFO supervisord 以 pid 1 开始2017-10-29 15:27:46,439 信息生成:'slurmd' 与 pid 92017-10-29 15:27:46,441 信息生成:“sshd”,pid 102017-10-29 15:27:46,443 信息生成:'munge' 与 pid 112017-10-29 15:27:46,443 信息生成:'slurmctld' 与 pid 122017-10-29 15:27:46,452 信息退出:munge(退出状态 0;未预期)2017-10-29 15:27:46,452 CRIT 收获未知 pid 13)2017-10-29 15:27:46,530 INFO 放弃:munge 进入 FATAL 状态,太多启动重试太快2017-10-29 15:27:46,531 信息退出:slurmd(退出状态 1;未预期)2017-10-29 15:27:46,535 信息放弃:slurmd 进入致命状态,太多启动重试太快2017-10-29 15:27:46,536 信息退出:slurmctld(退出状态 0;未预期)2017-10-29 15:27:47,537 INFO 成功:sshd 进入 RUNNING 状态,进程已停留超过 1 秒(startsecs)2017-10-29 15:27:47,537 INFO 放弃:slurmctld 进入致命状态,太多启动重试太快

  • This guide to start a SLURM VM via Vagrant .我试过了,但是复制我的 munge 键超时。

    sudo scp/etc/munge/munge.key vagrant@server:/home/vagrant/ssh:连接到主机服务器端口 22:连接超时失去联系

最佳答案

所以 ... 我们这里有一个现有的集群,但它运行的是较旧的 Ubuntu 版本,该版本与我运行 17.04 的工作站不能很好地融合。

所以在我的工作站上,我只是确保安装了 slurmctld(后端)和 slurmd,然后设置一个简单的 slurm.conf

ControlMachine=mybox
# ...
NodeName=DEFAULT CPUs=4 RealMemory=4000 TmpDisk=50000 State=UNKNOWN
NodeName=mybox CPUs=4 RealMemory=16000

之后我重新启动了 slurmcltd,然后是 slurmd。现在一切都很好:

root@mybox:/etc/slurm-llnl$ sinfo
PARTITION AVAIL TIMELIMIT NODES STATE NODELIST
demo up infinite 1 idle mybox
root@mybox:/etc/slurm-llnl$

这是一个退化的设置,我们的真实设置混合了开发和生产机器以及适当的分区。但这应该回答你的“后端真的可以成为客户”的问题。此外,我的机器实际上并不称为 mybox,但在任何一种情况下都与问题无关。

使用 Ubuntu 17.04,全部原装,使用 munge 进行通信(无论如何这是默认设置)。

编辑:即:

me@mybox:~$ COLUMNS=90 dpkg -l '*slurm*' | grep ^ii
ii slurm-client 16.05.9-1ubun amd64 SLURM client side commands
ii slurm-wlm-basic- 16.05.9-1ubun amd64 SLURM basic plugins
ii slurmctld 16.05.9-1ubun amd64 SLURM central management daemon
ii slurmd 16.05.9-1ubun amd64 SLURM compute node daemon
me@mybox:~$

关于linux - 在 Ubuntu 16.04 上模拟 SLURM,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/47002755/

24 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com