- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有这个问题:
SELECT ROUND(AVG(temp)*multT + conT,2) as temp,
FLOOR(timestamp/$secondInterval) as meh
FROM sensor_locass
LEFT JOIN sensor_data USING(sensor_id)
WHERE sensor_id = '$id'
AND project_id = '$project'
GROUP BY meh
ORDER BY timestamp ASC
目的是选择绘制图表的数据,我使用一个像素值的数据的平均值来使图表忠实于数据。
到目前为止,优化包括添加索引、在 MyISAM 和 InnoDB 之间切换,但没有成功。
由于时间间隔随图形缩放和数据收集周期而变化,我无法为 GROUP BY
语句创建单独的列,但是查询速度很慢。有没有人有优化此查询或表以使此分组更快的想法,我目前在 timestamp
、sensor_id
和 project_id
上有一个索引列,但不使用 timestamp
索引。
当使用查询运行 explain extended
时,我得到以下信息:
1 SIMPLE sensor_locass ref sensor_id_lookup,project_id_lookup sensor_id_lookup 4 const 2 100.00 Using where; Using temporary; Using filesort
1 SIMPLE sensor_data ref idsensor_lookup idsensor_lookup 4 webstech.sensor_locass.sensor_id 66857 100.00
sensor_data
表目前包含 270 万个数据点,这只是我最终必须处理的数据量的一小部分。欢迎任何有用的想法、评论或解决方案
编辑表格定义:
CREATE TABLE `sensor_data` (
`id` int(11) NOT NULL AUTO_INCREMENT,
`gateway_id` int(11) NOT NULL,
`timestamp` int(10) NOT NULL,
`v1` int(11) NOT NULL,
`v2` int(11) NOT NULL,
`v3` int(11) NOT NULL,
`sensor_id` int(11) NOT NULL,
`temp` decimal(5,3) NOT NULL,
`oxygen` decimal(5,3) NOT NULL,
`batVol` decimal(4,3) NOT NULL,
PRIMARY KEY (`id`),
KEY `gateway_id` (`gateway_id`),
KEY `time_lookup` (`timestamp`),
KEY `idsensor_lookup` (`sensor_id`)
) ENGINE=MyISAM AUTO_INCREMENT=2741126 DEFAULT CHARSET=latin1
CREATE TABLE `sensor_locass` (
`id` int(11) NOT NULL AUTO_INCREMENT,
`project_id` int(11) NOT NULL,
`sensor_id` int(11) NOT NULL,
`start` date NOT NULL,
`end` date NOT NULL,
`multT` decimal(6,3) NOT NULL,
`conT` decimal(6,3) NOT NULL,
`multO` decimal(6,3) NOT NULL,
`conO` decimal(6,3) NOT NULL,
`xpos` decimal(4,2) NOT NULL,
`ypos` decimal(4,2) NOT NULL,
`lat` decimal(9,6) NOT NULL,
`lon` decimal(9,6) NOT NULL,
`isRef` tinyint(1) NOT NULL,
PRIMARY KEY (`id`),
KEY `sensor_id_lookup` (`sensor_id`),
KEY `project_id_lookup` (`project_id`)
) ENGINE=MyISAM AUTO_INCREMENT=238 DEFAULT CHARSET=latin1
最佳答案
尽管每个人都有答案,但更改主键以优化对具有 238 行的表的搜索不会改变任何内容,尤其是当 EXPLAIN 显示单个键将搜索范围缩小到两行时。并且将 timestamp
添加到 sensor_data
上的主键也不会起作用,因为没有任何东西在查询时间戳,只是对其进行计算(除非您可以将时间戳值限制为 galymzhan建议)。
哦,您可以在查询中删除 LEFT
,因为 project_id
上的匹配无论如何都会使其无关紧要(但不会减慢任何速度)。如果这些变量来自客户输入,请不要将变量直接插入查询以避免 $project_id = "'; DROP TABLES; --"输入 sql 注入(inject)漏洞。
调整堆大小可能会奏效一段时间,但如果需要扩展,则必须继续调整。
vdrmrt 建议的答案可能有效,但随后您需要使用 $secondInterval 的每个可能值填充聚合表,鉴于您所说的灵 active ,我认为这不太合理。同样,您可以考虑 rrdtool ,直接使用它或以与它相同的方式修改您的数据。我具体指的是它将原始数据保留一段给定的时间(通常是几天),然后在越来越长的时间段内将数据点平均在一起。最终结果是您可以放大最近一段时间的高细节,但如果您进一步回顾,数据已经有效地有损压缩到很长一段时间内的平均值(例如,一天每秒一个数据点,一周每分钟一个数据点,一个月每小时一个数据点,等等)。您最初可以自定义这些平均值,但除非您同时保留原始数据和汇总数据,否则您将无法返回并进行调整。特别是,您无法动态放大到一些较旧的任意点的高细节(例如查看六个月前发生的 1 小时的每秒数据)。
因此,根据您的要求,您必须决定此类限制是否合理。
如果不是,那么我会争辩说您正试图在 MySQL 中做一些它不是为之设计的事情。我建议提取您需要的原始数据并在 php 中取平均值,而不是在您的查询中。正如已经指出的那样,您的查询花费很长时间的主要原因是因为 GROUP BY
子句迫使 mysql 处理内存中的所有数据,但由于它的数据太多,它实际上写入了该数据暂存盘。 (因此 using filesort
)。但是,就可以在 php 中使用多少内存而言,您有更大的灵 active 。此外,由于您正在组合附近的行,因此您可以逐行提取数据,动态组合它,因此永远不需要在您的 php 进程中将所有行保留在内存中。然后您可以删除 GROUP BY
并避免文件排序。请改用 ORDER BY timestamp
,如果 mysql 未正确优化它,请确保使用 FORCE INDEX FOR ORDER BY (timestamp)
关于php - 使用生成的 GROUP BY 语句优化 SQL 查询,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/4144780/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!