- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我是一名生物信息学家,最近开始学习 Python,我对绘制图形感兴趣。我有一组节点和边。
节点
set(['ACG', 'ATC', 'GAT', 'CGG', 'CGT', 'AAT', 'ATT', 'GGA', 'TTC', 'CCG', 'TCC', 'GAA'])
边缘
[('ACG', 'CGG'), ('CGG', 'GGA'), ('GGA', 'GAA'), ('GAA', 'AAT'), ('AAT', 'ATC'), ('GAT', 'ATT'), ('ATT', 'TTC'), ('TTC', 'TCC'), ('TCC', 'CCG'), ('CCG', 'CGT')]
当我使用上述信息构建法线图时,我得到 12 个节点和 10 个边,即使用以下函数的两个断开连接的图。
def visualize_de_bruijn():
""" Visualize a directed multigraph using graphviz """
nodes = set(['ACG', 'ATC', 'GAT', 'CGG', 'CGT', 'AAT', 'ATT', 'GGA', 'TTC', 'CCG', 'TCC', 'GAA'])
edges = [('ACG', 'CGG'), ('CGG', 'GGA'), ('GGA', 'GAA'), ('GAA', 'AAT'), ('AAT', 'ATC'), ('GAT', 'ATT'), ('ATT', 'TTC'), ('TTC', 'TCC'), ('TCC', 'CCG'), ('CCG', 'CGT')]
dot_str = 'digraph "DeBruijn graph" {\n'
for node in nodes:
dot_str += ' %s [label="%s"] ;\n' % (node, node)
for src, dst in edges:
dot_str += ' %s -> %s ;\n' % (src, dst)
return dot_str + '}\n'
在生物学中,我们有互补碱基配对的概念,其中 A=T、T=A、G=C 和 C=G。因此,'ACG' 的补码是 'TGC','ACG' 的反补码是 'CGT',即我们反转补码。
在节点列表中,我们看到 12 个节点,其中 6 个节点彼此反向互补,即
ReverseComplement('ACG') = CGT
ReverseComplement('CGG') = CCG
ReverseComplement('GGA') = TCC
ReverseComplement('GAA') = TTC
ReverseComplement('AAT') = ATT
ReverseComplement('ATC') = GAT
现在我想构造一个有六个节点的图,一个节点应该有自己的值及其反向补值和总共 10 条边,即图不应断开。如何在 python 中使用 graphviz 可视化该图?如果除了 graphviz 之外还有其他任何东西可以帮助我可视化这种类型的图表,请告诉我。?
最佳答案
我不太确定你想在这里完成什么(所以请注意,你可能有一个 XY problem) 但让我们回答你的问题,看看它会给我们带来什么。
a node should have its own value and its reverse complement value
所以我们需要一些对象来存储序列和该序列的反向补集。
有different ways of making the reverse complement of a sequence 。作为一名生物信息学家,您确实应该使用适合生物信息学的库,即 BioPython 。
然后进行反向补码如下所示:
from Bio.Seq import Seq
seq = 'ATCG'
print str(Seq(seq).reverse_complement()) # CGAT
但是生成 Seq
对象对于这个问题可能有点过分了,所以我只使用下面的标准字典。我们还希望将 Node
对象相互比较,因此我们需要重写 __eq__
。因为我们想要创建一组唯一的 Node
对象,所以我们还需要实现 __hash__
。为了 pretty-print ,我们还实现了__str__
。
class Node(object):
def __init__(self, seq):
self.seq = seq
self.revcompl = self.revcompl()
def revcompl(self):
complement = {'A': 'T', 'C': 'G', 'G': 'C', 'T': 'A'}
return "".join(complement.get(base, base) for base in reversed(self.seq))
def __eq__(self, other):
return self.seq == other.seq or self.revcompl == other.seq
def __hash__(self):
return hash(self.seq) ^ hash(self.revcompl)
def __str__(self):
return '({}, {})'.format(self.seq, self.revcompl)
现在我们可以将集合或原始节点转换为新节点列表及其反向补集。
nodes = set(['ACG', 'ATC', 'GAT', 'CGG', 'CGT', 'AAT', 'ATT', 'GGA', 'TTC', 'CCG', 'TCC', 'GAA'])
newnodes = set(Node(seq) for seq in nodes)
assert len(newnodes) == 6
现在我们需要连接节点。您并没有在问题中真正说明如何生成带有边缘的列表。您发布的内容的可视化看起来确实像您所描述的那样:两个断开连接的图表。
但是,当我创建 DeBruijn 图时,我会成对比较所有序列,看看它们之间是否有重叠,创建一个邻接列表,并从中生成 graphviz 的 DOT 代码。
from itertools import product
def suffix(seq, overlap):
return seq[-overlap:]
def prefix(seq, overlap):
return seq[:overlap]
def has_overlap_seq(seq1, seq2, overlap=2):
if seq1 == seq2:
return False
return suffix(seq1, overlap) == prefix(seq2, overlap)
def get_adjacency_list_seqs(sequences, overlap=2):
for seq1, seq2 in product(sequences, repeat=2):
if has_overlap_seq(seq1, seq2, overlap):
yield seq1, seq2
def make_dot_plot(adjacency_list):
"""Creates a DOT file for a directed graph."""
template = """digraph "DeBruijn graph"{{
{}
}}""".format
edges = '\n'.join('"{}" -> "{}"'.format(*edge) for edge in adjacency_list)
return template(edges)
如果我对您的原始节点
执行此操作,
seq_adjacency_list = get_adjacency_list_seqs(nodes)
print make_dot_plot(seq_adjacency_list)
我得到一个连接图:
所以我不确定您生成 edges
列表的原始实现中是否存在错误,或者您是否尝试做完全不同的事情。
现在,我们可以调整之前的序列字符串代码,以便也可以使用我们之前创建的 Node
对象。
def has_overlap_node(node1, node2, overlap=2):
if node1 == node2:
return False
return suffix(node1.seq, overlap) == prefix(node2.seq, overlap) or \
suffix(node1.seq, overlap) == prefix(node2.revcompl, overlap) or \
suffix(node1.revcompl, overlap) == prefix(node2.seq, overlap) or \
suffix(node1.revcompl, overlap) == prefix(node2.revcompl, overlap)
def get_adjacency_list_nodes(nodes, overlap=2):
for node1, node2 in product(nodes, repeat=2):
if has_overlap_node(node1, node2, overlap):
yield node1, node2
应用这个
nodes_adjacency_list = get_adjacency_list_nodes(newnodes)
print make_dot_plot(nodes_adjacency_list)
生成
它确实有 6 个节点,但有 12 个,而不是请求的 10 个边。
关于python - 绘制序列及其反向互补图,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/33101105/
我想填充 3D 等高线图 (contour3(X,Y,Z)),就像 2D 等高线填充图 (contourf(X,Y,Z))。但我无法弄清楚如何实现这一目标。 contour3 和 surf 的组合不是
我有一个 c3.js 折线图,表示 2 个值的演变。我需要折线图的工具提示是饼图(工具提示 = 另一个 c3.js 图形)。 这是我成功的: http://jsfiddle.net/owhxgaqm/
我有具有结构的 Pandas 数据框: A B 0 1 1 1 2 1 2 3 4 3 3 7 4 6 8 如何生成 Seaborn Violin 图,每列作为其自己的单独
我正在使用 D3DXSPRITE 方法将我的 map 图 block 绘制到屏幕上,我刚刚添加了一个缩放功能,当您按住向上箭头时会放大,但注意到您现在可以看到图 block 之间的间隙,这是一些屏幕截
1、系统环境如下图: 2、为该系统添加一块新的虚拟硬盘,添加后需重启虚拟机,否则系统不识别;如下图,/dev/sdc 是新添加的硬盘; 3、fdisk /dev/sdc为新硬盘创建分区:
1、nagios简介 nagios是一款开源的电脑系统和网络监视工具,能有效监控windows、linux和unix的主机状态,交换机路由器等网络设置,打印机等。在系统或服务状态异常时发
越来越多人开始习惯用手机上网,浏览网页、查看邮件···移动化已经成为互联网发展必然趋势,包括facebook在内的很多互联网公司都将移动广告作为下一个淘金地
1.图片处理 1.圆角图片 复制代码 代码如下: /** * 转换成圆角 * &n
Microsoft SQL Server Management Studio是SQL SERVER的客户端工具,相信大家都知道。我不知道大伙使用导入数据的情况怎么样,反正我最近是遇到过。主要是因为没
debian6系统: 首先先安装mysql吧: 打开终端(root)用户登入 apt-get purge mysql-server-5.5 安装完成后: 默认情况下Mysql只允许本地登录
fedora16英文环境下支持中文输入法的方法 fedora16英文环境下支持FCITX的中文输入法: $ im-chooser 就会出现选择界面,选择第二个就行了。
Net预编译命令 C:\WINDOWS\Microsoft.NET\Framework\v2.0.50727\aspnet_compiler.exe -? 显示说明 我们需要选择的命令为&n
有的时候电脑出现一些故障有的时候通过将其修改bios设置的方法来解决故障,那么在bios上设置能不能将电脑恢复出厂设置呢?其实也是可以的。方法也很简单的,只要会进入电脑的bios懂的上面英文的意思就
笔者曾介绍过Deepin 将对龙芯进行全面支持,打造最优美龙芯电脑桌面。现在Deepin团队移植工作取得了突破性的成果,Deepin桌面已经在龙芯3A和龙芯3B电脑上成功运行起来了。 以下为龙芯3
在安装一些软件之后,我们的电脑总是会发生一点小变化,不是桌面上多了几个网址图标,就是IE浏览器的默认主页被篡改成乱七八糟的网址。最可气的是,在IE设置中将默认主页改回来后,下次启动Win7后又变了回
“注册表编辑器怎么打开”虽说不是很难的问题,但是对于对电脑常识不是很擅长的网民来说,当电脑出现问题或需要更改设置时,着实还是件头疼的问题。因为需要打开注册表进行操作解决。那么如何打开注册表编辑器呢?
这篇文章重点介绍10个重要的WordPress安全插件和技巧,用来保护WordPress网站或者博客。 1. WP Security 人工帮助你修复被黑客入侵的网站,只要按照他们网站上的联系电话
其实运用object和javascript调用外部文件,也能实现不同栏目调用不同友情链接,即相当于调用不同栏目友情链接文件, {dede:field.typeid/}来获取当前栏目的ID。
我有一个复值矩阵。 如果我发出命令: plot(myMatrix) 然后它在图形设备上显示一种散点图,X 轴标记为 Re(myMatrix),Y 轴标记为 Im(myMatrix)。这显示了我正在寻找
关闭。这个问题需要更多focused .它目前不接受答案。 想改善这个问题吗?更新问题,使其仅关注一个问题 editing this post . 4年前关闭。 Improve this questi
我是一名优秀的程序员,十分优秀!