- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
好的,所以我正在观察某些我肯定会称之为“意外”的行为,并且我很好奇是否有人可以提供并了解地球上正在发生的事情。我会尽量保持简洁...
我有一个sqlite数据库,我正在使用Python(150k行,11个表)访问该数据库,以进行神经网络训练。两端无关紧要,但这意味着我的数据点以较大的blob的形式存储在一个表中,并且数据库大约为5GB。因为我只提取某些行(由于交叉验证或其他类型的过滤),所以我发现在某些有意义的列上建立索引可以显着提高速度。当阳光明媚时,我可以在2秒钟左右选择,获取并格式化大约500个数据点。这很棒。
但是,正如熟悉神经网络/反向传播软件/ SGD的任何人都可以证明的那样,根据数据和架构的不同,此过程可能会花费很长时间。为了使事情达到最佳并行化,我已购置了多台机器(Mac Pro,8GB RAM,16个知道速度的内核),以便在不同条件下以不同线程启动训练方案。由于内存的限制,上限大约是6或7个独立的线程,每个线程都访问同一数据库文件。现在,据我所知,这些机器是相同的。
这就是奇怪的地方。最初,我的基准计算机上的性能非常出色,并且并行线程数从未使速度变慢(一个线程与七个线程基本相等)。当我第一次将此数据库文件复制到其他计算机(并重新创建索引)时,一个速度与基准速度相同,但另一个速度则比基准速度快两倍。我当时(当时)认为这是硬件差异,然后继续生活。然后,修改了sqlite数据库并重新复制到所有计算机后,它现在在以前速度较慢的计算机上速度很快,而所有其他计算机的性能(包括基准)则较慢。
我不明白我对所有实例都做了同样的事情。数据库文件在复制时是相同的,然后删除/创建相同的索引,因为我敢肯定sqlite索引是指磁盘上的绝对位置。我在Unix环境中,因此文件碎片不应该成为罪魁祸首(对吗?)。并发在某些配置中似乎不是问题,而其他配置则会导致瓶颈。从那以后我检查了一下,发现机器实际上在纸上是一样的。对我来说,最令人困惑的部分是,在一台机器的配置中性能是不同的。
我真的很茫然。任何方向都将不胜感激。我绝不是精通关系数据库编程,但是在这一点上我没有想法。
更新:我可能已经“解决”了我的问题,但是这个问题绝没有得到解决。我发现,如果我基本上在每个系统上重新启动数据库文件,则最终可以使机器之间的性能相同。该过程类似于...
while unhappy:
1. Drop all indexes
2. Create new indexes
3. Make a handful of select/fetch calls
4. Commit / quit / restart
最佳答案
如果未使用auto_vacuum = FULL运行数据库,则可能是数据库文件中的数据结构有些碎片。您是否尝试在数据库上运行VACUUM?
关于python - 为什么在具有相同硬件的不同计算机上读取sqlite数据库速度较慢?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/6801248/
我在想出一个算法时遇到了麻烦... 我有一系列 GPS 数据,以 1 秒为间隔记录时间、速度、距离。假设距离是米,速度是米/秒。可能有超过 2 小时的数据,或 7200 个点。这里的“时间”字段主要是
使用java排序器,即: Collections.sort(myArrayList, new Comparator() { @Override public int c
有什么区别吗 SELECT * FROM my_table 和 SELECT my_column_id FROM my_table 地点: my_table 有百万行 网站上有大量并发用户进行sql查
有2个样本。 在第一个示例中,使用 orderby 可以更快地获得结果。 (根据 phpmyadmin 速度报告) 在另一个例子中,我没有使用 order by,它给出的结果较慢。 (根据 phpmy
我注意到,如果我将训练数据加载到内存中并将其作为 numpy 数组提供到图中,与使用相同大小的 shuffle 批次相比,速度会有很大差异,我的数据有大约 1000 个实例。 使用内存 1000 次迭
我在 python 中使用破折号。我正在绘制记录到 SQLite 数据库中的实时数据,目前,我正在绘制单个值与时间线图。我计划再添加 20 个图表,但目前,随着时间的增加, plotly 变慢,我认为
我试图调用 hasNext Velocity 模板中的方法,以便根据 foreach 循环中的位置影响行为 - 仅 hasNext没有按照文档工作。 这是 Velocity 用户指南的片段,关于 ha
在我正在制作的游戏中,我有两个点,pt1 和 pt2,我想计算出它们之间的角度。我已经在较早的计算中计算出距离。显而易见的方法是对垂直距离上的水平距离进行反正切 (tan(theta) = opp/a
我经常遇到字符串值不存在和/或为空的情况。这是测试这种情况的最佳方法吗? #if( $incentive.disclaimer && $!incentive.disclaimer != '' )
我想将一个模板nested包含在其他模板cont1,cont2和cont3中。 并且嵌套模板应仅对cont1隐藏一个特定控件。 在包含在cont1中之前,我想为一些标志变量$hideMyControl
是否可以更改从“Windows Azure Media Encoder”输出的音频的播放速度? 我正在使用配置为“WMA High Quality Audio”的“Windows Azure Medi
我使用速度将String(template)与字段合并 hi there I'am ${name}, And I'am ${age} old. velocity将字段${name}和${age}与一种
我使用的是 LockedBitmap 类,它简化了 C# 中位图数据的处理。目前它正在将数据复制到本地 byte[] 数组中,然后通过其类方法访问该数组以获取/设置像素颜色值。 这比直接通过指针访问锁
我尝试在 VM_global_library.vm 文件中添加一堆 #set($x=abc) 语句,但这些变量在我的 VM 模板中不可用。 我想为图像的基本路径等设置一个全局变量。这可能吗? 最佳答案
我的项目结构: -src --main ---java ----makers -----SomeClass ---resources ----htmlPattern.vm 如何告诉 SomeClass
我正在尝试从 Velocity 中的字符串中删除不需要的字符(换行符可以,但不能像 EM 和 CAN ASCII 控制字符那样)。 #set($cleanScreen = $cleanScreen.r
我想在日.月.年之间的点处分割日期。例如:2015 年 1 月 14 日至 {14, 01, 2015}这是我使用的代码:dates3.get(0) 包含我从页面的文本字段获取的字符串“14.01.2
之后,从 1.5 升级到速度引擎 1.7 出现了 1.5 没有的问题。为了解释这个问题,我必须展示一个代码片段: #foreach($someVariable in $someCollection)
我想知道从表中选择所有字段是否更快: SELECT * 或只选择您真正需要的: SELECT field1, field2, field3, field4, field5... 假设表有大约 10 个
我正在尝试模仿照片应用程序的行为,在该应用程序中,用户用手指平移照片并且照片具有一定的速度。由于我不会深入的原因,我不能将 UIScrollView 与它的缩放 UIImageView 一起使用,而是
我是一名优秀的程序员,十分优秀!