- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个奇怪的问题。根据像this这样的帖子我希望 IDLE 比在命令行上运行我的代码慢。然而,我看到完全相反的情况。
该程序比较两个文件并将匹配行配对在一起并将所有匹配项写入新文件。我认为它类似于 SQL 中的连接。但我需要忽略没有匹配项的行。以下是程序功能的概述:
程序似乎在尝试访问非常大的字典时卡住了。在 IDLE 下运行大约需要 2-3 分钟,但 1 小时后程序仍未在命令行上完成。当我访问 write_file 时,它的写入速度非常慢。
这是第一个文件的一些简化数据,其中数据由制表符分隔,数字是键,值是信息:
20\tinfo_first_file_20\n
18\tinfo_first_file_18\n
这是第二个文件的示例:
20\tinfo_second_file_20\n
30\tinfo_second_file_20\n
这是正在写入的文件的示例:
20\tinfo_first_file_20\t20\tinfo_second_file_20\n
函数
def pairer(file_1, file_2, write_file):
wf = open(write_file, 'w')
f1 = open(file_1, 'r')
line = f1.readline()
d = {}
while line != "":
key, value = line.strip('\n').split('\t')
d[key] = value
line = f1.readline()
f2 = open(file_2, 'r')
line_2 = f2.readline()
while line_2 != "":
key, value = line_2.strip('\n').split('\t')
if key in d.keys():
to_write = key +'\t' + d[key] + '\t' + key +'\t'+ value + '\n'
wf.write(to_write)
line_2 = f2.readline()
我如何在 IDLE 中运行代码
if __name__=="__main__":
pairer('file/location/of/file_1', 'file/location/of/file_2', 'file/location/of/write_file')
我如何在终端中运行代码
if __name__=="__main__":
parser = argparse.ArgumentParser()
parser.add_argument('file_1', action="store")
parser.add_argument('file_2', action="store")
parser.add_argument('write_file', action="store")
results = parser.parse_args()
pairer(results.file_1, results.file_2, results.write_file)
所有代码都是实际代码的简化。我希望我包含的内容足以让别人给我指出正确的方向,但不要太多,所以我要切中要点。我是编程新手,所以这可能是一个明显的问题,但我还没有找到任何东西。
使用终端时是否有字典的最大大小?它的存储方式是否不同,最终会耗尽我的内存力?
我有一台 Mac OSX 10.8。 Tkinter 已更新。我正在使用 python2.7。提前致谢。
编辑:
在程序到达这一点之前,它确实有大约 30 分钟的其他分析要做。但它只在这里失败。不确定这是否相关。另一部分只是将每个 ~30kb 的大文件分成 22 个较小的文件。这里不涉及字典,速度也差不多。所以我可以在更小的层面上处理数据。
编辑 2:
使用终端时内存清除是否不同?
我还注意到另一件事:当我查看 Activity Monitor 应用程序时,当我在 IDLE 中运行代码时,它似乎使用了更多的 CPU。我看起来它使用了不止一个处理器,但这没有意义。因为我的代码不是为并行运行而编写的。另外,当我在空闲状态下运行时,计算机会发出更多噪音。不是很定量,而是观察。
最佳答案
一个 1kb 的文件听起来很小,但这里有一些可能会解决问题的提示,因为这个问题有点含糊:
使用 argparse 意味着在命令行中你需要这样的东西:
python prog.py --file_1 file --file_2 file --write_file output
我不确定这是否是您想要的。您可以保持简单并执行以下操作:
if __name__ == '__main__':
file_1 = sys.argv[1]
file_2 = sys.argv[2]
write_file = sys.argv[3]
pairer(file_1, file_2, write_file)
你可以这样调用它:
python prog.py file_1 file_2 write_file
此外,这主要是一个样式问题,但我会稍微修改配对器 - 在文件上使用 for 循环,并且不要创建 keys() 列表。
def pairer(file_1, file_2, write_file):
d = {}
# using 'with' prevents lost resources!
with open(file_1, 'r') as f1:
for line in f1:
# no arguments in strip clears all whitespace
key, value = line.strip().split('\t')
d[key] = value
f2 = open(file_2, 'r')
line_2 = f2.readline()
with open(file_2, 'r') as f2, open(write_file, 'w') as wf:
key, value = line_2.strip().split('\t')
# don't do 'if key in d.keys()' because .keys() constructs a list of keys
# the in operator checks the key directly, which is O(1) instead of O(n)
# this should give you a pretty big speed boost
if key in d:
# this is probably a trivial speed difference, but you could try it this way:
to_write = '\t'.join([key, d[key], key, value + '\n'])
wf.write(to_write)
关于python - IDLE 和命令行之间的性能差异。 IDLE 表现更好的地方,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/17073692/
我有一个奇怪的问题。根据像this这样的帖子我希望 IDLE 比在命令行上运行我的代码慢。然而,我看到完全相反的情况。 该程序比较两个文件并将匹配行配对在一起并将所有匹配项写入新文件。我认为它类似于
我使用 emacs-24.5.1 浏览了 linux 内核代码,并使用 cedet(内联在 emacs 中)进行语义解析。 经过一些常规配置后,我用emacs打开init/main.c,出现了“Par
我写的字符串很长。为了便于阅读,我想将文本换行到多行。这是怎么做到的。我以前看过说明,但现在找不到了。 最佳答案 [这个答案一般适用于 Python,并不特定于 IDLE。] 对于没有嵌入换行符的长字
是否有任何现有的网络应用程序可以让多个用户同时使用交互式 IDLE 类型 session ? 类似于: IDLE 2.6.4 Morgan: >>> letters = list("abcdefg")
我是编程新手,我决定先学Python,所以; 我安装了 Python,最新版本 3.4。我正在尝试打开 Python IDLE(GUI) 模式,所以当我打开时,我收到消息“IDLE 的子进程没有建立连
最近很多用户发现system idle process占用率特别高,不知道什么意思,想要解决它。这个只是显示电脑剩余内存的,下面来看看想想的介绍吧。 system idle process占用率高
默认的 ATL 简单对象在其 IDL 文件的顶部具有以下内容: import "oaidl.idl"; import "ocidl.idl"; 这些文件有什么用,我怎么知道什么时候需要导入它们?是否有
这个问题在这里已经有了答案: How to clear the interpreter console? (30 个答案) 关闭 9 年前。 我正在运行一个脚本,该脚本使用的模块会在屏幕上打印很多内
这里 TP_DSCVoyChange 类有 KEY_DSC作为一个属性,我们要填充此 KEY_DSC 使用 TP_DSCVoyChange 使用 String 值从 Java 获取值构造函数。例如。
在我的 Mac 上,我通过自制软件安装了 python 3.9。 我尝试启动空闲并收到此错误: > idle3 ** IDLE can't import Tkinter. Your Python ma
我正在使用 this用于检测用户在我的应用程序中是否空闲的库。我正在使用 StartWatching(),在 onTimerStart 中,我现在只是打印控制台。 当用户空闲 N 秒时,onTimer
我们有一个 .NET 程序集(实际上是 Aspose.Words),我们希望客户端能够轻松地从 COM 客户端使用它。 因此,我们随程序集提供了 .TLB,以便客户端可以通过 C++ 或 Delphi
在之前的函数中,我创建并返回了一个哈希值。执行此操作后,它将哈希作为结构返回,我将其用作此以下函数的输入。 myStruct 的每个标签都是一个结构,每个都有一个名称和数据类型标签。 我正在尝试遍历每
假设我创建了以下 IDL 文件: module ProviderTest { interface Multiplier { long twice(in long number)
我有一个IDL文件,我使用scipy中的readsav将其导入Python,我更改了文件中的参数,我想将其导出/保存回原始格式,IDL可读。 这就是我导入它的方式: from scipy.io.idl
我正在尝试替换/删除文本文档中的一些行。该文档采用 ISO-8859-1 字符编码。 当我尝试将此行复制到我的 Python 脚本中进行替换时,它不会匹配。如果我缩短该行并删除直到第一个双引号 "它将
我的 Espresso 测试在 Espresso 版本 2.2.2 上运行良好,但是当我将我的工作室更新到最新版本并应用迁移规则时,测试将失败并需要更新版本。 库使用 androidTestImple
2013 年 4 月 15 日决议。 在 Windows 7(64 位)Windows 资源管理器中,当我右键单击 Python 文件并选择“使用 IDLE 编辑”时,编辑器会正确打开,但是当我运行(
我用的是3.8.10版本的Python.(32位)。我正在尝试在IDLE中导入NumPy包,但是我收到了这个消息。图像。我的Idle崩溃了,并显示以下信息。同样的事情也发生在其他包上,比如:Chain
IDL是什么意思?我用谷歌搜索了一下,发现它代表接口(interface)定义语言,用于组件的接口(interface)定义。但是,在实践中,IDL 的目的是什么?微软使用它吗? 最佳答案 接口(in
我是一名优秀的程序员,十分优秀!