- android - RelativeLayout 背景可绘制重叠内容
- android - 如何链接 cpufeatures lib 以获取 native android 库?
- java - OnItemClickListener 不起作用,但 OnLongItemClickListener 在自定义 ListView 中起作用
- java - Android 文件转字符串
抱歉篇幅太长,想给出一个完整的描述!我需要显示一份报告,显示有关另一个表中的 id 的一些信息,以及当有人在 x 天内从一个国家/地区更改国家/地区时。请注意,我如何可以在表中多次为一个 ID 使用相同的国家/地区条目(因为信息会定期多次查询,但在那段时间它们可能没有移动),并且还可以有不同的国家/地区条目(因为它们更改国家/地区)。
数据的快速解释:我有下表:
CREATE TABLE IF NOT EXISTS `country` (
`id` mediumint(8) unsigned NOT NULL,
`timestamp` datetime NOT NULL,
`country` varchar(64) DEFAULT NULL,
PRIMARY KEY (`id`,`timestamp`),
KEY `country` (`country`),
KEY `timestamp` (`timestamp`)
) ENGINE=InnoDB DEFAULT CHARSET=utf8;
条目是这样的:
41352 2012-03-26 15:46:01 Jamaica
41352 2012-03-05 22:49:41 Jamaican Applicant
41352 2012-02-26 15:46:01 Jamaica
41352 2012-02-16 12:11:19 Jamaica
41352 2012-02-05 23:00:30 Jamaican Applicant
该表目前总共约有 214,590 行,但一旦测试数据被替换为真实数据,将会有数百万行。
我想要的是关于自 y 时间以来离开 x 国家/地区的每个人的一些信息。假设它是在上面的数据上运行的,我希望它的输出方式如下:
id name last country TIMESTAMP o_timestamp
41352 Sweet Mercy Jamaica 2012-03-26 15:46:01 2012-03-05 22:49:41
41352 Sweet Mercy Jamaica 2012-02-16 12:11:19 2012-02-05 23:00:30
o_timestamp 比某个日期(比如说 100)更新的地方,国家是他们搬到的地方,他们来自的旧国家(未显示)是我传递给查询的任何内容(牙买加申请人基于上述数据) .
为了满足需求,我开发了以下查询,并使用某个id进行测试:
SELECT a.id,
c.name,
c.last,
a.country,
a.timestamp,
b.timestamp AS o_timestamp
FROM country a
INNER JOIN user_info c
ON ( a.id = c.id )
LEFT JOIN country AS b
ON ( a.id = b.id
AND a.timestamp != b.timestamp
AND a.country != b.country )
WHERE b.timestamp = (SELECT c.timestamp
FROM country c
WHERE a.id = c.id
AND a.timestamp > c.timestamp
ORDER BY c.timestamp DESC
LIMIT 1)
AND a.id = 965
我完成了这个(总共 7 次,查询用了 0.0050 秒)
扩展解释揭示了以下内容:
id select_type table type possible_keys key key_len ref rows filtered Extra
1 PRIMARY c const PRIMARY PRIMARY 3 const 1 100.00
1 PRIMARY a ref PRIMARY PRIMARY 3 const 16 100.00
1 PRIMARY b eq_ref PRIMARY,timestamp PRIMARY 11 const,func 1 100.00 Using where
2 DEPENDENT SUBQUERY c index PRIMARY,timestamp timestamp 8 NULL 1 700.00 Using where; Using index
所以我觉得我很不错,于是就加入了这个:
SELECT a.id,
c.name,
c.last,
a.country,
a.timestamp,
b.timestamp AS o_timestamp
FROM country a
INNER JOIN user_info c
ON ( a.id = c.id )
LEFT JOIN country AS b
ON ( a.id = b.id
AND a.timestamp != b.timestamp
AND a.country != b.country )
WHERE b.timestamp = (SELECT c.timestamp
FROM country c
WHERE a.id = c.id
AND a.timestamp > c.timestamp
ORDER BY c.timestamp DESC
LIMIT 1)
AND b.country = "whatever" AND timestamp > DATE_SUB(NOW(), INTERVAL 7 DAY)
在一个拥有 200 条记录且从未完成的国家/地区(在下午和晚上外出和
对于一个在数据库中有 9000 条记录的国家/地区,总共需要大约 8 个小时才能回家。在真实数据中,一个国家可能在那里容易 10000 倍。 100k 不会不合理。
所以我确实解释了扩展,并得到了这个:
id select_type table type possible_keys key key_len ref rows filtered Extra
1 PRIMARY <derived2> ALL NULL NULL NULL NULL 3003 100.00
1 PRIMARY c eq_ref PRIMARY PRIMARY 3 b.id 1 100.00
1 PRIMARY a ref PRIMARY PRIMARY 3 b.id 7 100.00 Using where
3 DEPENDENT SUBQUERY c index PRIMARY,timestamp timestamp 8 NULL 1 700.00 Using where; Using index
2 DERIVED country range country,timestamp country 195 NULL 474 100.00 Using where; Using index
所以它看起来更大,但并非没有道理。
[删除了空间的配置变量,如果需要请告诉我,还有性能信息,因为它可能是一个查询问题。]
如果我遗漏了什么,请告诉我。
最佳答案
问题不在于添加标准;它正在掉落一个造成伤害的东西。在原始查询中,您有:
AND a.id = 965
这意味着查询执行不需要读取整个a
(country
) 表。在您的第二个性能下降的查询中,您将该标准更改为:
AND b.country = "whatever"
AND timestamp > DATE_SUB(NOW(), INTERVAL 7 DAY)
您不再对 a
有真正的限制性标准,因此工作速度要慢得多。
当意识到 b
是对 country
的另一个引用时,事情变得更加复杂。然而,从 a
到 b
的条件(其中 b
位于外部连接的外侧)的变化并非微不足道;处理查询条件需要更长的时间。
Does that mean because I'm not looking for a specific id, I'm out of luck?
对于给定的查询结构,答案似乎是"is",但我们可以说,给定的查询结构可能是次优的。
您的“处理一个 ID 时足够快”查询是:
SELECT a.id,
c.name,
c.last,
a.country,
a.timestamp,
b.timestamp AS o_timestamp
FROM country a
INNER JOIN user_info c
ON ( a.id = c.id )
LEFT JOIN country AS b
ON ( a.id = b.id
AND a.timestamp != b.timestamp
AND a.country != b.country )
WHERE b.timestamp = (SELECT c.timestamp
FROM country c
WHERE a.id = c.id
AND a.timestamp > c.timestamp
ORDER BY c.timestamp DESC
LIMIT 1)
AND a.id = 965
我不完全理解这个查询以及它试图做什么。您需要注意外连接比内连接更昂贵,并且外连接表上的条件如
b.timestamp = (...correlated sub-query...)
非常昂贵。一个问题是 b
列中可能有一个 NULL,包括 timestamp
,但是子查询被浪费了,因为除非值是非空的,所以我们最终想知道“为什么要进行 OUTER 连接”?
当您添加修改后的条件时,您应该收到“列名不明确”错误,因为该时间戳可能来自 a
或 c
。此外,b.country = "whatever"
条件是另一个只有当 b
值不为 null 时才有意义的条件,因此 OUTER 连接也是可疑的。
据我了解,country
表包含有关谁进入哪个国家以及何时的记录。此外,FWIW,我可以肯定的是,与 user_info
表的连接是一个可以忽略不计的性能问题;问题全在于对 country
表的三个引用。
从一些说明来看,您可以逐步构建查询,也许是这样的。
查找同一 id
的每对国家记录,其中记录在时间顺序上相邻,并且较早的记录对应给定国家(“牙买加申请人”)和较新的适用于不同的国家/地区。
最简单的部分是:
SELECT a.id, a.country, a.timestamp, b.country, b.timestamp
FROM country AS a
JOIN country AS b
ON a.id = b.id
AND b.timestamp > a.timestamp
AND a.country = 'Jamaica Applicant'
AND b.country != a.country
这完成了大部分工作,但不能确保条目的邻接性。为此,我们必须坚持在 country
表中没有记录在两个时间戳 a 之间(但不包括)相同的
和id
。时间戳b.timestamp
。这是一个额外的 NOT EXISTS 条件:
SELECT a.id,
a.country AS o_country,
a.timestamp AS o_timestamp,
b.country AS n_country,
b.timestamp AS n_timestamp
FROM country AS a
JOIN country AS b
ON a.id = b.id
AND b.timestamp > a.timestamp
AND a.country = 'Jamaica Applicant'
AND b.country != a.country
WHERE NOT EXISTS
(SELECT *
FROM country AS c
WHERE c.timestamp > a.timestamp
AND c.timestamp < b.timestamp
AND c.id = a.id
)
请注意,BETWEEN AND 符号不适用。它包括范围内的端点,但我们明确需要排除端点。
鉴于上面的国家/地区条目列表,我们现在只需要选择那些...嗯,那么,标准是什么?我想你可以选择,但结果可以很容易地与 user_info
表连接:
SELECT e.id, u.name, u.last, e.o_country, e.o_timestamp, e.n_country, e_n_timestamp
FROM (SELECT a.id,
a.country AS o_country,
a.timestamp AS o_timestamp,
b.country AS n_country,
b.timestamp AS n_timestamp
FROM country AS a
JOIN country AS b
ON a.id = b.id
AND b.timestamp > a.timestamp
AND a.country = 'Jamaica Applicant'
AND b.country != a.country
WHERE NOT EXISTS
(SELECT *
FROM country AS c
WHERE c.timestamp > a.timestamp
AND c.timestamp < b.timestamp
AND c.id = a.id
)
) AS e
JOIN user_info AS u ON e.id = u.id
WHERE e.o_timestamp > DATE_SUB(NOW(), INTERVAL 7 DAY);
我不保证性能会更好(甚至它在语法上是正确的;它还没有通过 SQL DBMS)。但我认为用于获取相邻日期的复杂查询结构比原始代码更简洁并且性能可能更好。请特别注意,它不使用任何外部连接、(显式)排序或限制子句。这应该有所帮助。
关于mysql - 为什么向此 MySQL 查询添加特定的 where 子句会成为性能瓶颈?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/10067954/
在这段令人惊叹的视频 ( https://www.youtube.com/watch?v=udix3GZouik ) 中,Alex Blom 谈到了 Ember 在移动世界中的“黑客攻击”。 在 22
我们希望通过我们的应用收集使用情况统计信息。因此,我们希望在服务器端的某个地方跟踪用户操作。 就性能而言,哪个选项更合适: 在 App Engine 请求日志中跟踪用户操作。即为每个用户操作写入一个日
在针对对象集合的 LINQ 查询的幕后究竟发生了什么?它只是语法糖还是发生了其他事情使其更有效的查询? 最佳答案 您是指查询表达式,还是查询在幕后的作用? 查询表达式首先扩展为“普通”C#。例如: v
我正在构建一个简单的照片库应用程序,它在列表框中显示图像。 xaml 是:
对于基于 Web 的企业应用程序,使用“静态 Hashmap 存储对象” 和 apache java 缓存系统有何优缺点?哪一个最有利于性能并减少堆内存问题 例如: Map store=Applica
我想知道在性能方面存储类变量的最佳方式是什么。我的意思是,由于 Children() 函数,存储一个 div id 比查找所有其他类名更好。还是把类名写在变量里比较好? 例如这样: var $inne
我已经阅读了所有这些关于 cassandra 有多快的文章,例如单行读取可能需要大约 5 毫秒。 到目前为止,我不太关心我的网站速度,但是随着网站变得越来越大,一些页面开始需要相当多的查询,例如一个页
最近,我在缓存到内存缓存之前的查询一直需要很长时间才能处理!在这个例子中,它花费了 10 秒。在这种情况下,我要做的就是获得 10 个最近的点击。 我感觉它加载了所有 125,592 行然后只返回 1
我找了几篇文章(包括SA中的一些问题),试图找到基本操作的成本。 但是,我尝试制作自己的小程序,以便自己进行测试。在尝试测试加法和减法时,我遇到了一些问题,我用简单的代码向您展示了这一点
这个问题在这里已经有了答案: Will Java app slow down by presence of -Xdebug or only when stepping through code? (
我记得很久以前读过 with() 对 JavaScript 有一些严重的性能影响,因为它可能对范围堆栈进行非确定性更改。我很难找到最近对此的讨论。这仍然是真的吗? 最佳答案 与其说 with 对性能有
我们有一个数据仓库,其中包含非规范化表,行数从 50 万行到 6 多万行不等。我正在开发一个报告解决方案,因此出于性能原因我们正在使用数据库分页。我们的报告有搜索条件,并且我们已经创建了必要的索引,但
我有一条有效的 SQL 语句,但需要很长时间才能处理 我有一个 a_log 表和一个 people 表。我需要在 people 表中找到给定人员的每个 ID 的最后一个事件和关联的用户。 SELECT
很难说出这里问的是什么。这个问题是含糊的、模糊的、不完整的、过于宽泛的或修辞性的,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开它,visit the help center 。 已关
通常当我建立一个站点时,我将所有的 CSS 放在一个文件中,并且一次性定义与一组元素相关的所有属性。像这样: #myElement { color: #fff; background-
两者之间是否存在任何性能差异: p { margin:0px; padding:0px; } 并省略最后的分号: p { margin:0px; padding:0px } 提前致谢!
我的应用程序 (PHP) 需要执行大量高精度数学运算(甚至可能出现一共100个数字) 通过这个论坛的最后几篇帖子,我发现我必须使用任何高精度库,如 BC Math 或 GMP,因为 float 类型不
我一直在使用 javamail 从 IMAP 服务器(目前是 GMail)检索邮件。 Javamail 非常快速地从服务器检索特定文件夹中的消息列表(仅 id),但是当我实际获取消息(仅包含甚至不包含
我非常渴望开发我的第一个 Ruby 应用程序,因为我的公司终于在内部批准了它的使用。 在我读到的关于 Ruby v1.8 之前的所有内容中,从来没有任何关于性能的正面评价,但我没有发现关于 1.9 版
我是 Redis 的新手,我有一个包含数百万个成员(member) ID、电子邮件和用户名的数据集,并且正在考虑将它们存储在例如列表结构中。我认为 list 和 sorted set 可能最适合我的情
我是一名优秀的程序员,十分优秀!