python - 在规则中使用配置数据的语法-6ren

python - 在规则中使用配置数据的语法

转载作者：太空宇宙更新时间：2023-11-03 14:56:47

26

4

是否有地方完整描述了snakemake规则中配置数据的使用？

用户指南中的 yaml 文件中有一个示例:

samples:
    A: data/samples/A.fastq
    B: data/samples/B.fastq

然后，它在如下规则中使用:

bam=expand("sorted_reads/{sample}.bam", sample=config["samples"]),

上面的代码似乎会将 {sample} 替换为“data/samples/A.fastq”，而不是像它显然那样替换为“A”(和“B”等)。

在输出规则中使用配置数据的正确方法是什么，例如帮助形成输出文件名？此表单不起作用:

output: "{config.dataFolder}/{ID}/{ID}.yyy"

如果我在 yaml 文件中定义复杂的结构化数据，我正在寻找语法指导 - 如何在蛇规则中使用它？什么时候使用Python语法，什么时候使用SnakeMake语法？

yaml 和 JSON 配置文件受到严格限制，因为它们无法使用文件中先前定义的值来定义新值，对吧？这是设置配置参数时经常要做的事情。

使用配置文件有什么好处？为什么不直接使用 include: an include python 文件来定义参数？

一个有用的东西是一本全面描述 SnakeMake 细节的引用手册。当前的网站有点分散，需要一段时间才能找到您记得以前在其中某个地方看到过的内容。

最佳答案

在“输出”规则中应该如何使用配置数据？我发现输出字符串不能包含 {config.} 值。但是，可以使用 Python 代码包含它们，如下所示:

output: config["OutputDir"] + "/myfile.txt"

但是，此方法不起作用(在输出:或输入:):

params: config=config
output: "{params.config[OutputDir]}/myfile.txt"

但是，它确实可以在“shell:”中工作:

params: config=config
output: config["OutputDir"] + "/myfile.txt"
shell: echo "OutputDir is {params.config[OutputDir]}" > {output}

请注意，shell cmd 中 [] 内的 OutputDir 周围没有引号。扩展字符串中的值的 {} 方法不使用键周围的引号。

配置数据可以按蛇文件方式或按Python方式定义吗？是的!

参数可以在使用“configfile”包含的 .yaml 文件中定义，或者通过使用“include”包含的常规 Python 文件定义。恕我直言，后者更优越，因为 .yaml 文件不允许定义引用以前的定义，这在除最简单的配置文件之外的所有配置文件中都很常见。

使用 yaml 定义上面的“OutputDir”参数:

xxx.yaml:

OutputDir: DATA_DIR

蛇文件:

configfile: 'xxx.yaml'

使用 Python 定义它以与上面完全兼容:

xxx.py:

config['OutputDir'] = "DATA_DIR"

蛇文件:

include: 'xxx.py'

或者，在 Python 包含的配置文件中定义一个简单的变量“OutputDir”，然后在规则中使用它:

xxx.py:

OutputDir = "DATA_DIR"

蛇文件:

include: 'xxx.py'
rule:
    output: OutputDir + "/myfile.txt"

可以通过 .yaml 文件和 python 文件轻松定义和访问多重嵌套字典和列表。示例:

MACBOOK> cat cfgtest.yaml
cfgtestYAML:

    A: 10
    B: [1, 2, 99]
    C:
        nst1: "hello"
        nst2: ["big", "world"]

MACBOOK> cat cfgtest.py
cfgtestPY = {

    'X': -2,
    'Y': range(4,7),
    'Z': {
        'nest1': "bye",
        'nest2': ["A", "list"]
        }
    }

MACBOOK> cat cfgtest
configfile: "cfgtest.yaml"
include: "cfgtest.py"

rule:
    output: 'cfgtest.txt'
    params: YAML=config["cfgtestYAML"], PY=cfgtestPY
    shell:
        """
        echo "params.YAML[A]: {params.YAML[A]}"             >{output}
        echo "params.YAML[B]: {params.YAML[B]}"             >>{output}
        echo "params.YAML[B][2]: {params.YAML[B][2]}"       >>{output}
        echo "params.YAML[C]: {params.YAML[C]}"             >>{output}
        echo "params.YAML[C][nst1]: {params.YAML[C][nst1]}" >>{output}
        echo "params.YAML[C][nst2]: {params.YAML[C][nst2]}" >>{output}
        echo "params.YAML[C][nst2][1]: {params.YAML[C][nst2][1]}" >>{output}

        echo "" >>{output}

        echo "params.PY[X]: {params.PY[X]}"                 >>{output}
        echo "params.PY[Y]: {params.PY[Y]}"                 >>{output}
        echo "params.PY[Y][2]: {params.PY[Y][2]}"           >>{output}
        echo "params.PY[Z]: {params.PY[Z]}"                 >>{output}
        echo "params.PY[Z][nest1]: {params.PY[Z][nest1]}"     >>{output}
        echo "params.PY[Z][nest2]: {params.PY[Z][nest2]}"     >>{output}
        echo "params.PY[Z][nest2][1]: {params.PY[Z][nest2][1]}" >>{output}
        """

MACBOOK> snakemake -s cfgtest
Provided cores: 1
Rules claiming more threads will be scaled down.
Job counts:
    count   jobs
    1   1
    1

rule 1:
    output: cfgtest.txt
    jobid: 0

Finished job 0.
1 of 1 steps (100%) done

MACBOOK> cat cfgtest.txt
params.YAML[A]: 10
params.YAML[B]: 1 2 99
params.YAML[B][2]: 99
params.YAML[C]: {'nst1': 'hello', 'nst2': ['big', 'world']}
params.YAML[C][nst1]: hello
params.YAML[C][nst2]: big world
params.YAML[C][nst2][1]: world

params.PY[X]: -2
params.PY[Y]: range(4, 7)
params.PY[Y][2]: 6
params.PY[Z]: {'nest1': 'bye', 'nest2': ['A', 'list']}
params.PY[Z][nest1]: bye
params.PY[Z][nest2]: A list
params.PY[Z][nest2][1]: list

关于python - 在规则中使用配置数据的语法，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/45494047/

26

4

0

文章推荐： Python pandas 循环值以两列为条件

文章推荐： c# - 使用 C# 在 JIRA SERVER 中的 Jira Rest API 登录错误

文章推荐： azure - azure 网站中的空 ssl 证书列表

文章推荐： c# - VS2017 显示错误 : Dictionary is not a collection

java - 配置 logback 以遵循 Java 配置，也就是 Logback 的纯 Java 配置
我只是不喜欢 Logback 的 XML 或 Groovy 配置，而更喜欢用 Java 进行配置(这也是因为我将在初始化后的不同时间在运行时更改配置)。似乎对 Logback 进行 Java 配置的
yaml - sphinx 配置 ||配置/sphinx.yml
我的 sphinx 配置是: ================================ config/sphinx.yml development: bin_path: "/usr/loc
Sitecore 性能优化 - Sitecore 配置、IIS 配置
我们计划在生产服务器中部署我们的系统。我有兴趣了解更多有关优化网站性能的信息。 Sitecore 有哪些优化建议？ (缓存，网络配置中的其他设置) 我们可以在 IIS 中做哪些优化？找不到关于这些主
python - 根目录上静态站点的 Apache 配置，子位置上的 Django 配置
我有一个 Django 应用程序，可以处理网站的两个(或更多)部分，例如网站的“admin”和“api”部分。我还为网站的其余部分提供了普通的 html 页面，其中不需要 Django。例如，我希望
node.js - 配置 Dockerfile 以设置 AWS 配置
我刚刚开始研究Docker。我有一个 Node 应用程序，可以调整大小和图像，然后在完成后向 aws 发送 SQS 消息。我已成功创建应用程序的 docker 镜像，并从本地计算机复制它，但遇到了无法
ant - 如何在 Hudson 中为 Ant 配置 checkstyle 配置？
如何配置 checkstyle(在 Ant nt Maven 中)任务？我尝试了一点，但没有正确收到报告。这是我的 Ant 脚本。
java - 如何将 xml 配置 bean 转换为 Java 配置 bean？
我正在使用 Quartz 和 Spring 框架重写一个遗留项目。原始配置是 XML 格式，现在我将其转换为 Java Config。 xml 配置使用 jobDetail 设置触发器 bean 的作
mysql - 最佳 Mysql 配置(分区)和索引/Hypertable/RAID 配置(大数据库)
tl;rd: 使用主键对数据库进行分区索引大小问题。数据库大小每天增长约 1-3 GB 突袭设置。您有使用 Hypertable 的经验吗？长版: 我刚刚建立/购买了一个家庭服务器: 至强 E
使用图形 API 配置 GCP 的 Azure AD saml 配置 "Sign on URL"
在安装 gcp 应用程序后，我们尝试使用 GCP 的图形 api 配置 Azure Active Directory saml 配置。我们正在遵循相同的 AWS graph api saml 设置 U
java - 如何使用 Spring-Security 3 和 Hibernate 4 将 spring security xml 配置 hibernate 转换为 java 配置
我刚刚了解了 spring security 并想使用 java hibernate 配置连接到数据库，但我发现的示例或教程很少。我通过使用 xml 配置找到了更多。我在这里使用 Spring 4.0
java - 是否可以通过 jboss-deployment-struction.xml 配置 JPA 2.1，为 Spring 4 和 Hibernate 4.3.10 配置 JBoss EAP 6.4.x？
我们最近切换到 Java 8 以使用 java.time API(LocalDate、LocalDateTime，...)。因此，我们将 Hibernate 依赖项更新到版本 4.3.10。我们编写了
quarkus实战之六：配置
欢迎访问我的GitHub 这里分类和汇总了欣宸的全部原创(含配套源码)：https://github.com/zq2599/blog_demos 本篇概览本文是《quarkus实战》系列的第六篇，咱
NGINX 配置 :
我是 NGINX 的新手，我正在尝试对我们的 ERP 网络服务器进行负载平衡。我有 3 个网络服务器在由 websphere 提供支持的端口 80 上运行，这对我来说是一个黑盒子: * web01.e
Gerrit 配置
我们想使用 gerrit 进行代码审查，但我们在 webview 中缺少一些设置。是否可以禁止提交者审查/验证他们自己的提交？是否有可能两个审稿人给 +1 一个累积它到+2，以便可以提交？谢
AEM 配置
配置根据运行模式应用于 AEM 实例。在多个运行模式和多个配置的情况下，AEM 如何确定要选择的配置文件？假设以下配置在 AEM 项目中可用， /apps /myproject - con
Neo4j 配置
我正在使用 Neo4j 服务器。我遇到了负载相对较低的问题。但是，响应时间相当长。我认为为请求提供服务的线程数太少了。有没有办法调整为 HTTP 请求提供服务的线程池的大小。那可能吗？最佳答案线程
CELERYD_OPTS 配置
我在/etc/default/celeryd 中有以下配置 CELERYD_NODES = "worker1 worker2 worker3" CELERYD_CHDIR = "path to pro
Plone 配置
Plone 在其页面中显示来 self 的母语(巴西葡萄牙语)的特殊字符。但是，当我使用我创建的 spt 页面时，它会显示转义序列，例如: Educa\xc3\xa7\xc3\xa3o 代替 Educ
Emacs 配置
我正在尝试开始使用 Emacs/Clojure。安装 emacs 扩展的正确方法是什么。我正在尝试安装以下插件: https://bitbucket.org/kotarak/vimclojure 我已
CMake 配置
我有一个简单的 C 项目结构: proj/ src/ docs/ build/ tests/ lib/ 尝试编写合适的 CMake 文件。到目前为止我的尝试:http://pas

首页

博学

6Ren·AI

商城

python - 在规则中使用配置数据的语法