sql - 优化 Postgresql 查询-6ren

sql - 优化 Postgresql 查询

转载作者：行者123 更新时间：2023-11-29 12:14:23

25

4

我有两个表，我必须查询我的 postgresql 数据库。表 1 有大约 1.4 亿条记录，表 2 有大约 5000 万条记录。

表 1 的结构如下:

tr_id bigint NOT NULL, # this is the primary key
query_id numeric(20,0),       # indexed column
descrip_id numeric(20,0)      # indexed column

表2的结构如下

query_pk  bigint # this is the primary key
query_id  numeric(20,0)    # indexed column
query_token numeric(20,0)

table1 的样本数据库是

table2 的样本数据库是

我更喜欢可以在 tr_id block 中查询的查询。在 10,000 的范围内，因为这是我的要求。

我想以下面的方式得到输出

25  {9554,9456,9785,9514}
26  {7412,7433}
27  {545,5789,1566}
28  {122,1456}

我尝试了以下方式

select query_id, 
       array_agg(query_token) 
from sch.table2 
where query_id in (select query_id 
                   from sch.table1 
                   where tr_id between 90001 and 100000) 
group by query_id

我正在执行以下查询，大约需要 121346 毫秒，当触发大约 4 个这样的查询时，它仍然需要更长的时间。你能帮我优化一下吗？

我有一台在 Windows 7 上运行的机器，配备 i7 第二代处理器和 8GB 内存。

以下是我的postgresql配置

shared_buffers = 1GB    
effective_cache_size = 5000MB
work_mem = 2000MB

我应该怎么做才能优化它。

谢谢

编辑:如果结果按照以下格式排序就好了

25  {9554,9456,9785,9514}
28  {122,1456}
27  {545,5789,1566}
26  {7412,7433}

即根据 table1 中存在的 queryid 的顺序由 tr_id 排序。如果这在计算上很昂贵，可能在客户端代码中，我会尝试优化它。但我不确定它的效率如何。

谢谢

最佳答案

查询

我希望 JOIN 比您目前拥有的 IN 条件快得多:

SELECT t2.query_id
      ,array_agg(t2.query_token) AS tokens
FROM   t1
JOIN   t2 USING (query_id)
WHERE  t1.tr_id BETWEEN 1 AND 10000
GROUP  BY t1.tr_id, t2.query_id
ORDER  BY t1.tr_id;

这也会根据要求对结果进行排序。 query_token 根据 query_id 保持未排序。

索引

显然，您需要在 t1.tr_id 和 t2.query_id 上建立索引。
你显然已经有了那个:

CREATE INDEX t2_query_id_idx ON t2 (query_id);

t1 上的多列索引可能会提高性能(您必须进行测试):

CREATE INDEX t1_tr_id_query_id_idx ON t1 (tr_id, query_id);

服务器配置

如果这是一个专用的数据库服务器，您可以将 effective_cache_size 的设置提高一些。

@Frank 已经在 work_mem 上给出了建议。我引用 the manual :

Note that for a complex query, several sort or hash operations might be running in parallel; each operation will be allowed to use as much memory as this value specifies before it starts to write data into temporary files. Also, several running sessions could be doing such operations concurrently. Therefore, the total memory used could be many times the value of work_mem;

它应该足够大，能够在 RAM 中对您的查询进行排序。 10 MB 足以一次容纳 10000 行。如果您有一次需要更多的查询，请将其设置得更高。

在专用数据库服务器上有 8 GB，我很想将 shared_buffers 设置为至少 2 GB。

shared_buffers = 2GB    
effective_cache_size = 7000MB
work_mem = 10MB

关于 performance tuning in the Postgres Wiki 的更多建议.

关于sql - 优化 Postgresql 查询，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/9781234/

25

4

0

文章推荐： parsing - PostgreSQL 对极短查询的解析异常缓慢

文章推荐： c# - 带参数的 OdbcCommand 不返回任何内容

c++ - 为什么 MSVC 不为 char 或 const char* 优化 cout 而为 int 优化？
比较代码: const char x = 'a'; std::cout > (0C310B0h) 00C3100B add esp,4 和 const i
Matlab 优化
您好，我正在使用 Matlab 优化求解器，但程序有问题。我收到此消息 fmincon 已停止，因为目标函数值小于目标函数限制的默认值，并且约束满足在约束容差的默认值范围内。我也收到以下消息。警告:矩
Eclipse 优化
处理Visual Studio optimizations的问题为我节省了大量启动和使用它的时间当我必须进行 J2EE 开发时，我很难回到 Eclipse。因此，我还想知道人们是否有任何提示或技巧可
Excel 优化
情况如下:在我的 Excel 工作表中，有一列包含 1-name 形式的条目。考虑到数字也可以是两位数，我想删除这些数字。这本身不是问题，我让它工作了，只是性能太糟糕了。现在我的程序每个单元格输入大约
jQuery 优化
这样做有什么区别吗: $(".topHorzNavLink").click(function() { var theHoverContainer = $("#hoverContainer");
jQuery $(this) 优化
这个问题已经有答案了: 已关闭11 年前。 Possible Duplicate: What is the cost of '$(this)'? 我经常在一些开发人员代码中看到$(this)引用同一个
jQuery 优化
我刚刚结束了一个大型开发项目。我们的时间紧迫，因此很多优化被“推迟”。既然我们已经达到了最后期限，我们将回去尝试优化事情。我的问题是:优化 jQuery 网站时您要寻找的最重要的东西是什么。或者，我
JavaScript 优化
所以我一直在用 JavaScript 编写游戏(不是网络游戏，而是使用 JavaScript 恰好是脚本语言的游戏引擎)。不幸的是，游戏引擎的 JavaScript 引擎是 SpiderMonkey
MYSQL查询、优化
这是我在正在构建的页面中使用的 SQL 查询。它目前运行大约 8 秒并返回 12000 条记录，这是正确的，但我想知道您是否可以就如何使其更快提出可能的建议？ SELECT DISTINCT Adve
SQL 优化
如何优化这个？ SELECT e.attr_id, e.sku, a.value FROM product_attr AS e, product_attr_text AS a WHERE e.attr
python - 优化 `in`
我正在使用这样的结构来测试是否按下了所需的键: def eventFilter(self, tableView, event): if event.type() == QtCore.QEven
JavaScript 优化
我正在使用 JavaScript 从给定的球员列表中计算出羽毛球 double 比赛的所有组合。每个玩家都与其他人组队。 EG。如果我有以下球员a、b、c、d。它们的组合可以是: a & b V c
Javascript 优化
我似乎无法弄清楚如何让这个 JS 工作。 scroll function 起作用但不能隐藏。还有没有办法用更少的代码行来做到这一点？我希望 .down-arrow 在 50px 之后 fade out
CSS高级最小化(优化)
我的问题是关于用于生产的高级优化级联样式表 (CSS) 文件。多么最新和最完整(准备在实时元素中使用)的 css 优化器/最小化器，它们不仅提供删除空格和换行符，还提供高级功能，如删除过多的属性、合
HTML 优化
我读过这个: 浏览器检索在中请求的所有资源开始呈现之前的 HTML 部分.如果您将请求放在中section 而不是，那么页面呈现和下载资源可以并行发生。您应该从移动尽可能多的资源请求。
C++ 优化
我正在处理一些现有的 C++ 代码，这些代码看起来写得不好，而且调用频率很高。我想知道我是否应该花时间更改它，或者编译器是否已经在优化问题。我正在使用 Visual Studio 2008。这是一
c++ - 优化
我正在尝试使用 OpenGL 渲染 3 个四边形(1 个背景图，2 个 Sprite )。我有以下代码: void GLRenderer::onDrawObjects(long p_dt) {
Java If 优化
我确实有以下声明: isEnabled = false; if(foo(arg) && isEnabled) { .... } public boolean foo(arg) { some re
SQL 优化
(一)深入浅出理解索引结构实际上，您可以把索引理解为一种特殊的目录。微软的SQL SERVER提供了两种索引：聚集索引(clustered index，也称聚类索引、簇集索引)和非聚集索引(no
CSS 优化、提高性能的方法有哪些？
一、写在前面 css的优化方案，之前没有提及，所以接下来进行总结一下。二、具体优化方案 2.1、加载性能 1、css压缩：将写好的css进行打包，可以减少很多的体积。 2、css单一样式：在需要下边

首页

博学

6Ren·AI

商城

sql - 优化 Postgresql 查询

查询

索引

服务器配置