postgresql - 在处理文本搜索和地理空间数据时如何影响 Postgres 查询分析器-6ren

postgresql - 在处理文本搜索和地理空间数据时如何影响 Postgres 查询分析器

转载作者：行者123 更新时间：2023-11-29 12:14:29

31

4

我无法解决以下语句的严重性能问题。

给定情况

我有一个安装了 Postgis 1.4 的 postgres 8.4 数据库
我有一个包含大约 900 万个条目的地理空间表。该表有一个(postgis)几何列和一个 tsvector 列
我在几何体上有一个 GIST 索引，在 vname 列上有一个 VNAME 索引
表是ANALYZE

我想在这些几何图形的子集中执行 to_tsquery 文本搜索，这应该会返回所有受影响的 ID。

要搜索的区域会将 900 万个数据集限制在大约 100.000 个，并且此区域内 ts_query 的结果集很可能会给出 0..1000 个条目的输出。

问题

查询分析器决定他想首先对 vname 进行位图索引扫描，然后聚合并在几何上放置过滤器(以及我在该语句中的其他条件)

查询分析器输出:

Aggregate  (cost=12.35..12.62 rows=1 width=510) (actual time=5.616..5.616 rows=1 loops=1)
->  Bitmap Heap Scan on mxgeom g  (cost=8.33..12.35 rows=1 width=510) (actual time=5.567..5.567 rows=0 loops=1)
     Recheck Cond: (vname @@ '''hemer'' & ''hauptstrasse'':*'::tsquery)
     Filter: (active AND (geom && '0107000020E6100000010000000103000000010000000B0000002AFFFF5FD15B1E404AE254774BA8494096FBFF3F4CC11E40F37563BAA9A74940490200206BEC1E40466F209648A949404DF6FF1F53311F400C9623C206B2494024EBFF1F4F711F404C87835954BD4940C00000B0E7CA1E4071551679E0BD4940AD02004038991E40D35CC68418BE49408EF9FF5F297C1E404F8CFFCB5BBB4940A600006015541E40FAE6468054B8494015040060A33E1E4032E568902DAE49402AFFFF5FD15B1E404AE254774BA84940'::geometry) AND (mandator_id = ANY ('{257,1}'::bigint[])))
     ->  Bitmap Index Scan on gis_vname_idx  (cost=0.00..8.33 rows=1 width=0) (actual time=5.566..5.566 rows=0 loops=1)
           Index Cond: (vname @@ '''hemer'' & ''hauptstrasse'':*'::tsquery)

这会导致大量 I/O - AFAIK 首先限制几何形状，然后再进行 vname 搜索会更聪明。

尝试的解决方案

为了实现我想要的行为

我将 geom @@ AREA 放入子选择中 -> 没有更改执行计划
我创建了一个具有所需区域子集的临时 View -> 没有更改执行计划
我创建了所需区域的临时表 -> 创建需要 4 到 6 秒，这让情况变得更糟。

顺便说一句，很抱歉没有发布实际查询:我想如果我发布了，我的老板真的会生我的气，而且我正在寻找更多的理论指导，以便有人解决我的实际查询。请询问您是否需要进一步说明

编辑

Richard 有一个很好的观点:您可以使用 width 语句实现 Query Planner 的预期行为。坏处是这个临时表(或 CTE)弄乱了 vname 索引，从而使查询在某些情况下不返回任何内容。

我能够通过使用 to_tsvector() 即时创建一个新的 vname 来解决这个问题，但这(太)昂贵了 - 每个查询大约 300 - 500 毫秒。

我的解决方案

我放弃了 vname 搜索并使用简单的 LIKE('%query_string%')(10-20 毫秒/查询)，但这在我给定的环境中速度很快。 YMMV.

最佳答案

tsvector 的统计处理有一些改进(我认为 PostGIS 也是如此，但我不使用它)。如果您有时间，可能值得再次尝试 9.1 版本，看看它对您有什么帮助。

但是，对于这个单个查询，您可能需要查看 WITH 构造。

http://www.postgresql.org/docs/8.4/static/queries-with.html

如果您将几何部分作为 WITH 子句，它将首先被评估(保证)，然后该结果集将被以下 SELECT 过滤。不过它最终可能会变慢，直到您尝试才会知道。

这可能是对 work_mem 的调整也会有所帮助 - 您可以在每个 session 中执行此操作(“SET work_mem = ...”)，但要小心将其设置得太高 - 并发查询会很快耗尽所有 RAM。

http://www.postgresql.org/docs/8.4/static/runtime-config-resource.html#RUNTIME-CONFIG-RESOURCE-MEMORY

关于postgresql - 在处理文本搜索和地理空间数据时如何影响 Postgres 查询分析器，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/8180774/

31

4

0

文章推荐： ios - UIScrollView 卡住了

文章推荐： ios - 导航栏在 iPhone 4 (iOS 7.1.2) 中消失

文章推荐： android - 如何减少我的 MAF 应用程序的内存大小

postgres-xl - 在单机配置上设置 Postgres-XL
我想知道这里是否有人有安装 Postgres-XL 的经验，新的开源多线程版本的 PostgreSQL。我计划将一组 1-2 TB 的数据库从常规 Postgres 9.3 迁移到 XL，并且想知道这
postgresql - postgres 备份脚本不是 postgres 用户
我想创建一个 postgres 备份脚本，但我不想使用 postgres 用户，因为我所在的 unix 系统几乎没有限制。我想要做的是在 crontab 上以 unix 系统(网络)的普通用户身份运行
node-postgres - 在 node-postgres 中使用字符串文字进行参数化查询
我正在尝试编写一个 node-postgres 查询，它采用一个整数作为参数在间隔中使用: const query = { text: `SELECT foo
postgresql - 如何从命令行停止 (postgres.app) postgres 集群
如何在不使用 gui 的情况下停止特定的 Postgres.app 集群。我想使用 bash/Terminal.app 而不是 gui 我还应该指出，Postgres 应用程序有一个这样的菜单如果
security - 在 POSTGRES 数据库中为 'postgres' 用户添加密码是个好主意吗？
关闭。这个问题是opinion-based .它目前不接受答案。想要改进这个问题？更新问题，以便 editing this post 可以用事实和引用来回答它. 关闭 9 年前。 Improve
postgresql - Postgres docker "User "postgres“没有分配密码。”
我正在使用 docker 运行 Postgres 图像。它曾经在 Windows10 和 Ubuntu 18.04 上运行没有任何问题。在 Ubuntu 系统上重新克隆项目后，它在运行 docker
python - 从另一个 postgres 表更新一个 postgres 表
我正在使用 python(比如表 A)将批处理 csv 文件加载到 postgres。我正在使用 pandas 将数据上传到更快的 block 中。 for chunk in pd.read_csv(
postgresql - 在源 Postgres 服务器离线时迁移 Postgres DB
所以是的，标题说明了一切，我需要以某种方式将 DB 从源服务器获取到新服务器，但更重要的是旧服务器正在崩溃 :P 有什么方法可以将它全部移动到新服务器并导入它？旧服务器只是拒绝再运行 Postgre
postgresql - Postgres systemd 单元文件如何确定要运行的 Postgres 版本？
这主要是出于好奇而提出的问题。我正在浏览 Postgres systemd 单元文件，以了解 systemd 可以做什么。 Postgres 有两个 systemd 单元文件。一个用于代替 syste
postgresql - 为什么 Postgres 不要求用户 postgres 的密码？
从我在 pg_hba.conf 中读到的内容，我推断，为了确保提示我输入 postgres 用户的密码，我应该从当前的“对等”编辑 pg_hba.conf 的前两个条目的方法'到'密码'或'md5'，
sql - Postgres : user mapping not found for "postgres"
我已连接到架构 apm。尝试执行函数并出现以下错误: ERROR: user mapping not found for "postgres" 数据库连接信息说: apm on postgres@
postgresql - 无法创建用户 postgres : role "postgres" does not exists
我在 ubuntu 12.04 服务器上，我正在尝试安装 postgresql。截至目前，我已成功安装它但无法配置它。我需要创建一个角色才能继续前进，我在终端中运行了这个命令: root@hostna
database - 无法以 'postgres' 用户身份登录到 'postgres' 数据库
我无法以“postgres”用户身份登录到“postgres”数据库。操作系统:REHL 服务器版本 6.3PostgreSQL 版本:8.4有一个数据库“jiradb”用作 JIRA 6.0.8 的
postgresql - 在 docker postgres 容器中导入 postgres 数据库
我正在尝试将现有数据库导入 postgres docker 容器。这就是我的处理方式: docker run --name pg-docker -e POSTGRES_PASSWORD=*****
postgresql - 重新启动 postgres 后使用 Grails 自动重新连接到 postgres
我们的 Web 应用程序在 postgres 9.3 和 Grails 2.5.3 上运行。当我们重新启动 postgres (/etc/init.d/postgresql restart) 并访问网
postgresql - 如何将现有的 postgres 数据文件夹复制和使用到 docker postgres 容器中
我想构建 postgres docker 容器来测试一些问题。我有: postgres 文件的归档文件夹(/var/lib/postgres/data/) 将文件夹放入 docker postgres
postgresql - 如何将 postgres json 列表转换为全小写的 postgres 数组
我有一个名为“stuff”的表，其中有一个名为“tags”的 json 列，用于存储标签列表，还有一个名为“id”的列，它是表中每一行的主键。我正在使用 postgres 数据库。例如，一行看起来像这
python - postgres 中的锁定机制/postgres 中的死锁。 [我正在使用 sqlalchemy]
我对 sqlalchemy-psql 中的锁定机制是如何工作的感到非常困惑。我正在运行一个带有 sqlalchemy 和 postgres 的 python-flask 应用程序。由于我有多个线程处理
sql - Postgres 函数比查询/Postgres 8.4 慢
我(必须)使用 Postgres 8.4 数据库。在这个数据库中，我创建了一个函数: CREATE OR REPLACE FUNCTION counter (mindate timestamptz,m
linux - Postgres : psql: FATAL: role "postgres" does not exist
我已经使用 PostgreSQL 几天了，它运行良好。我一直在通过默认的 postgres 数据库用户和另一个具有权限的用户使用它。今天中午(在一切正常之后)它停止工作，我再也无法回到数据库中。我会

首页

博学

6Ren·AI

商城

postgresql - 在处理文本搜索和地理空间数据时如何影响 Postgres 查询分析器