postgresql - PostgreSQL 如何在字段上执行带有 b 树索引的 ORDER BY？-6ren

postgresql - PostgreSQL 如何在字段上执行带有 b 树索引的 ORDER BY？

转载作者：行者123 更新时间：2023-11-29 11:56:49

24

4

我有一个表bsort:

CREATE TABLE bsort(a int, data text);

此处数据可能不完整。换句话说，一些元组可能没有 data 值。

然后我在表上建立一个 b-tree 索引:

CREATE INDEX ON bsort USING BTREE(a);

现在如果我执行这个查询:

SELECT * FROM bsort ORDER BY a;

PostgreSQL 是对具有 nlogn 复杂度的元组进行排序，还是直接从 b-tree 索引中获取顺序？

最佳答案

对于像这样的简单查询，Postgres 将使用 index scan并按顺序从索引中检索易于排序的元组。由于其 MVCC model Postgres 必须始终另外访问“堆”(数据页)以验证条目对当前事务是否确实可见。引用 Postgres Wiki on index-only scans :

PostgreSQL indexes do not contain visibility information. That is, itis not directly possible to ascertain if any given tuple is visible tothe current transaction, which is why it has taken so long for index-onlyscans to be implemented.

这最终发生在 9.2 版本中: index-only scans 。 The manual:

If the index stores the original indexed data values (and not somelossy representation of them), it is useful to support index-only scans, in which the index returns the actual data not just the TID ofthe heap tuple. This will only avoid I/O if the visibility map showsthat the TID is on an all-visible page; else the heap tuple must bevisited anyway to check MVCC visibility. But that is no concern of theaccess method's.

visibility map 决定是否可以进行仅索引扫描。如果所有涉及的列值都包含在索引中，则只有一个选项。否则，无论如何都必须(另外)访问堆。 仍然不需要排序步骤。
这就是为什么我们现在有时会将无用的列附加到索引中。喜欢 data您示例中的列:

CREATE INDEX ON bsort (a, data); -- btree is the default index type
它使索引更大(取决于)并且维护和用于其他目的的成本更高。所以只附加 data如果您从中获得仅索引扫描，则列。索引中列的顺序很重要:

Working of indexes in PostgreSQL

Is a composite index also good for queries on the first field?

从 Postgres 11 开始，也有 INCLUDE 的“覆盖索引”关键词。喜欢:

CREATE INDEX ON bsort (a) INCLUDE (data);
参见:

Does a query with a primary key and foreign keys run faster than a query with just primary keys?

仅索引扫描的好处，per documentation:

If it's known that all tuples on the page are visible, the heap fetchcan be skipped. This is most noticeable on large data sets where thevisibility map can prevent disk accesses. The visibility map is vastlysmaller than the heap, so it can easily be cached even when the heapis very large.

可见性 map 由 VACUUM 维护如果你有autovacuum，这会自动发生正在运行(现代 Postgres 中的默认设置)。详情:

Are regular VACUUM ANALYZE still recommended under 9.1?

但是在对表的写操作和下一个 VACUUM 之间有一些延迟运行。它的要点:

只读表在清理后随时准备进行仅索引扫描。

被修改的数据页在可见性映射中失去它们的“全部可见”标志，直到下一个VACUUM。 (并且所有旧的交易都已完成)，因此这取决于写操作与 VACUUM 之间的比率频率。

如果涉及的页面一些被标记为全部可见，则部分仅索引扫描仍然是可能的。但是如果无论如何都要访问堆，访问方法“索引扫描”会更便宜一些。所以如果当前有太多页面是脏的，Postgres 将完全切换到更便宜的索引扫描。 The Postgres Wiki again :

As the number of heap fetches (or "visits") that are projected to beneeded by the planner goes up, the planner will eventually concludethat an index-only scan isn't desirable, as it isn't the cheapestpossible plan according to its cost model. The value of index-onlyscans lies wholly in their potential to allow us to elide heap access(if only partially) and minimise I/O.

关于postgresql - PostgreSQL 如何在字段上执行带有 b 树索引的 ORDER BY？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/31576669/

24

4

0

文章推荐： mysql - 真的很难理解这个查询

文章推荐： php - 解析错误 : syntax error, 意外 '$_GET' (T_VARIABLE)

文章推荐： ruby-on-rails - 销毁一些记录需要非常非常长的时间

文章推荐： postgresql - Heroku PostgreSQL 用户和数据库创建

mysql修改记录时update操作字段=字段+字符串
在有些场景下，我们需要对我们的varchar类型的字段做修改，而修改的结果为两个字段的拼接或者一个字段+字符串的拼接。如下所示，我们希望将xx_role表中的name修改为name+id。
MySQL SUM IF 字段 b = 字段 a
SELECT incMonth as Month, SUM( IF(item_type IN('typ1', 'typ2') AND incMonth = Month, 1, 0 ) )AS
java - 如果直接从内存读取 volatile 字段，那么从哪里读取非 volatile 字段？
我最近读到 volatile 字段是线程安全的，因为 When we use volatile keyword with a variable, all the threads read its va
python - 在数据库中已有数据之后添加的 UUID 字段。有没有办法为现有数据填充 UUID 字段？
我在一些模型中添加了一个 UUID 字段，然后使用 South 进行了迁移。我创建的任何新对象都正确填充了 UUID 字段。但是，我所有旧数据的 UUID 字段为空。有没有办法为现有数据填充 UUI
php - 左连接中的两个表都有 id 字段。尝试从第一个数据库中提取 id 字段，但获取第二个数据库
刚刚将我的网站从 mysql_ 更新为 mysqli，并破坏了之前正常运行的查询。我试图从旋转中提取 id，因为它每次都会增加 1，但我不断获取玩家 id，有人可以告诉我我做错了什么吗？我尝试了将
mysql - 如何使用 MySQL 将一个表中的一列(字段)复制到另一个表的空列(字段)，这两个表都是同一数据库的一部分？
我在 Mac OS X 上使用带有 Sequel Pro 的 MySQL。我想将一个表中的一个字段(即名为“GAME_DY”的列)复制到另一个名为“DAY_ID”的表的空字段中。两个表都是同一数据库的
java - 为序列化设置一个 transient 字段，但为 JPA 设置非 transient 字段
问题: 是否有可能有一个字段被 JPA 保留但被序列化跳过？可以实现相反的效果(JPA 跳过字段而序列化则不会)，如果使用此功能，那么相反的操作肯定会很有用。类似这样的事情: @Entity cl
php - 无重复(分组依据)字段 1 循环，字段 2 位于水平线
假设我有一个名为“dp”的表 Year | Month | Payment| Payer_ID | Payment_Recipient | 2008/2009 | July
c - 我在 IP header 中找不到 DSCP 字段，只有已弃用的 TOS 字段
我将尝试通过我的 Raspberry Pi 接入点保证一些 QoS。开始之前，我先动手:我阅读了有关 tcp、udp 和 ip header 的内容。在IP header description我看
dart - 什么时候应该在 dart 中使用 final 字段、工厂构造函数或带有 getter 的私有(private)字段？
如果你能弄清楚如何重命名这个问题，我愿意接受建议。在 Dart 语言中，可以编写一个带有 final 字段的类。这些是只能设置的字段构造函数前 body 跑。这可以在声明中(通常用于类中的静态常量)
javascript - jquery:使用两个带有两个字段(字段 1、字段 2 + 1 天)的日期选择器，例如 booking.com
你怎么样？我有两个带有两个字段的日期选择器我希望当用户选择 (From) 时，第二个字段 (TO) 将是 next day 。比如 booking.com 例如:当用户选择From 01-01-2
mysql - 将字段从 T1 字段 A 复制到 T2 字段 A where(if or when) T1 field B = T2 field B (mysql)
我想我已经看到了这个问题的一些答案，这些答案可能与我需要的相差不远，但我对 mysql 的了解还不够确定，所以我会根据我的具体情况提出问题。我有一个包含多个表的数据库，为此，如果“image”表上的
mySQL在单个查询中多次使用相同的表/字段
我在 mySQL 数据库中有 2 个表: customers ============ customer_id (1, 2 ) customer_name (john, mark) orders ==
数据库归档与基于时间段的表/字段
我正在开发一个员工目标 Web 应用程序。领导/经理在与团队成员讨论后为他们设定目标。这是一年/半年/季度，具体取决于组织遵循的评估周期。现在的问题是添加基于时间段的字段或存档上一季度/年度数据的
Sitecore 字段，用于从媒体库中选择多个文件并能够上传文件
我正在寻找允许内容编辑器从媒体库中选择多个文件的东西，这些文件将在渲染中列出。他们还需要能够上传文件和搜索。它必须在页面编辑器(版本 8 中称为体验编辑器)中工作。到目前为止我所考虑的: 一堆文件字
r - 创建 "other"字段
现在，我有以下由 original.df %.% group_by(Category) %.% tally() %.% arrange(desc(n)) 创建的 data.frame。 DF 5),
潘塔霍。将登录的错误消息放入字符串/字段
我想知道是否有一些步骤/解决方案可以处理错误消息并将它们放入 Pentaho 工具中的某个字符串或字段中？例如，如果连接到数据库时发生某些错误，则将该消息从登录到字符串/字段。最佳答案我们在作业的
iPhone如何制作 "To"字段，如短信应用程序
如何制作像短信应用程序一样的“收件人”字段？例如，右侧有一个“+”按钮，当添加某人时，名称将突出显示并可单击，如圆角矩形等。有没有内置的框架？最佳答案不，但请参阅 Three20 的 TTMess
delphi - 列出记录的元素\字段
是否可以获取记录的元素或字段的列表通过类型信息类似于类的已发布属性的列表吗？谢谢！最佳答案取决于您的delphi版本，如果您使用的是delphi 2010或更高版本，则可以使用“新rtti”
带有外键列表的 SQLite 字段
我正在构建一个 SQLite 数据库来保存我的房地产经纪人的列表。我已经能够使用外键来识别每个代理的列表，但我想在每个代理的记录中创建一个列表；从代理商和列表之间的一对一关系转变为一对多关系。看这里

首页

博学

6Ren·AI

商城

postgresql - PostgreSQL 如何在字段上执行带有 b 树索引的 ORDER BY？