MySQL 速度慢，表中有大文本字段-6ren

MySQL 速度慢，表中有大文本字段

转载作者：行者123 更新时间：2023-11-29 01:37:09

28

4

我们在使用 MySQL(以及 MariaDB)时遇到了一个奇怪的问题。一个简单的数据库，有 2 个表(InnoDB 引擎)，都包含(以及其他一些)3 或 4 个带有 XML 数据的文本列。大小为 1-5kB。每个表大约有 40000 行，除了外键索引外没有索引。

奇怪的部分是运行 select 语句。 XML 列在 select 语句(select、where、order、group、...)中的任何地方都没有使用，但它们会减慢执行速度。如果这些列为空，则 select 语句的执行时间不到 2 秒，但如果它们包含数据，则执行时间会跳到 20 秒左右。这是为什么？!

这是一个脚本，可生成一个行为与上述类似的示例:

CREATE TABLE tableA (
    id                  bigint(20)      NOT NULL AUTO_INCREMENT,
    col1                bigint(20)      NULL,
    col2                bigint(20)      NULL,
    date1               datetime        NULL,
    largeString1        text            NULL,
    largeString2        text            NULL,
    largeString3        text            NULL,
    largeString4        text            NULL,
    PRIMARY KEY (id)
) DEFAULT CHARSET=utf8;

CREATE TABLE tableB (
    id              bigint(20)  NOT NULL AUTO_INCREMENT,
    col1            bigint(20)  NULL,
    col2            varchar(45) NULL,
    largeString1    text        NULL,
    largeString2    datetime    NULL,
    largeString3    text        NULL,
    PRIMARY KEY (id)
) DEFAULT CHARSET=utf8;

填表:

DELIMITER ;;
CREATE PROCEDURE `fillTables`(
    numRows INT
)
BEGIN

    DECLARE i INT;
    DECLARE j INT;
    DECLARE largeString TEXT;
    SET i = 1;

    START TRANSACTION;

    WHILE i < numRows DO
        SET j = 1;
        SET largeString = '';
        WHILE j <= 100 DO
            SET largeString = CONCAT(largeString, (SELECT UUID()));
            SET j = j + 1;
        END WHILE;

        INSERT INTO tableA (id, col1, col2, date1, largeString1,
                           largeString2, largeString3, largeString4)
           VALUES (i, FLOOR(1 + RAND() * 2), numRows - i, 
                   date_sub(now(), INTERVAL i hour),
                   largeString, largeString, largeString, largeString);
        INSERT INTO tableB (id, col1, col2, largeString1,
                           largeString2, largeString3)
           VALUES (numRows - i, i, (SELECT UUID()),
                   largeString, largeString, largeString);
        SET i = i + 1;
    END WHILE;

    COMMIT;

    ALTER TABLE tableA ADD FOREIGN KEY (col2) REFERENCES tableB(id);
    CREATE INDEX idx_FK_tableA_tableB ON tableA(col2);
    ALTER TABLE tableB ADD FOREIGN KEY (col1) REFERENCES tableA(id);
    CREATE INDEX idx_FK_tableB_tableA ON tableB(col1);

END ;;

测试

CREATE PROCEDURE `test`(
    _param1     bigint
    ,_dateFrom  datetime
    ,_dateTo    datetime
)
BEGIN

    SELECT 
        a.id
        ,DATE(a.date1) as date
        ,COALESCE(b2.col2, '') as guid
        ,COUNT(*) as count
    FROM
        tableA a
        LEFT JOIN tableB b1 ON b1.col1 = a.id
        LEFT JOIN tableB b2 ON b2.id = a.col2
    WHERE
        a.col1 = _param1
        AND (_dateFrom IS NULL OR DATE(a.date1) BETWEEN DATE(_dateFrom) AND DATE(_dateTo))
    GROUP BY
        a.id
        ,DATE(a.date1)
        ,b2.col2
    ;

END;;
DELIMITER ;

使用随机数据填充表格

call fillTables(40000);

用于检索数据的存储过程:

call test(2, null, null);

此外，MSSQL 在几分之一秒内执行 select 语句，没有任何表优化(即使没有定义外键)。

更新:

显示两个表的创建表:

'CREATE TABLE `tableA` (
  `id` bigint(20) NOT NULL AUTO_INCREMENT,
  `col1` bigint(20) DEFAULT NULL,
  `col2` bigint(20) DEFAULT NULL,
  `date1` datetime DEFAULT NULL,
  `largeString1` text,
  `largeString2` text,
  `largeString3` text,
  `largeString4` text,
  PRIMARY KEY (`id`),
  KEY `idx_FK_tableA_tableB` (`col2`),
  CONSTRAINT `tableA_ibfk_1` FOREIGN KEY (`col2`) REFERENCES `tableB` (`id`)
) ENGINE=InnoDB AUTO_INCREMENT=40000 DEFAULT CHARSET=utf8'


'CREATE TABLE `tableB` (
  `id` bigint(20) NOT NULL AUTO_INCREMENT,
  `col1` bigint(20) DEFAULT NULL,
  `col2` varchar(45) DEFAULT NULL,
  `largeString1` text,
  `largeString2` datetime DEFAULT NULL,
  `largeString3` text,
  PRIMARY KEY (`id`),
  KEY `idx_FK_tableB_tableA` (`col1`),
  CONSTRAINT `tableB_ibfk_1` FOREIGN KEY (`col1`) REFERENCES `tableA` (`id`)
) ENGINE=InnoDB AUTO_INCREMENT=40000 DEFAULT CHARSET=utf8'

最佳答案

两个表都需要 INDEX(col1)。没有它，这些需要表扫描:

WHERE a.col1 = _param1

ON b1.col1 = a.id

对于 a 这将是“覆盖”，因此更快:

INDEX(col1, date1, id, col2)

除非需要，否则不要使用 LEFT。

函数中尽量不要隐藏列；它阻止为它们使用索引:

DATE(a.date1) BETWEEN ...

这可能适用于:

    a.date1 >= DATE(_dateFrom)
AND a.date1  < DATE(_dateTo) + INTERVAL 1 DAY

至于 20 秒 vs 2 秒之谜 -- 您是否对每个计时测试进行了两次？第一次经常被 I/O 拖累；第二个是内存限制。

ROW_FORMAT

在 InnoDB 中有 4 个 ROW_FORMATs；它们的主要区别在于它们处理大字符串的方式(TEXT、BLOB 等)。您提到使用 NULL 字符串比使用非空字符串查询运行得更快。使用默认的 ROW_FORMAT，部分或全部 XML 字符串与其余列一起存储。在一些限制之后，其余的放在另一个 block 中。

如果一个大字段是NULL，那么它几乎不占用空间。

使用 ROW_FORMAT=DYNAMIC(参见 CREATE TABLE 和 ALTER TABLE)，非空列将倾向于被推送到其他 block 而不是使记录的主要部分变得庞大。

这具有允许更多行适合单个 block 的效果(溢出除外)。这反过来又允许某些查询运行得更快，因为它们可以用更少的 I/O 获取更多信息。

阅读文档，我认为你需要这些:

SET GLOBAL innodb_file_format=Barracuda;
SET GLOBAL innodb_file_per_table=1;
ALTER TABLE tbl ROW_FORMAT=DYNAMIC;

在阅读文档时，您将遇到COMPRESSED。尽管这会将 XML 缩小 3:1，但还有其他问题。我不知道它最终是否会变得更好。

缓冲池

innodb_buffer_pool_size 应该是可用 RAM 的大约 70%。

关于MySQL 速度慢，表中有大文本字段，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/38308717/

28

4

0

文章推荐： ios - 在 iOS 应用程序中的 Google plus 集成上崩溃

文章推荐： ios - 为什么在添加 Alamofire 框架时会出现很多错误？

文章推荐： mysql - WHERE语句查找一个月内所有记录？

mysql修改记录时update操作字段=字段+字符串
在有些场景下，我们需要对我们的varchar类型的字段做修改，而修改的结果为两个字段的拼接或者一个字段+字符串的拼接。如下所示，我们希望将xx_role表中的name修改为name+id。
MySQL SUM IF 字段 b = 字段 a
SELECT incMonth as Month, SUM( IF(item_type IN('typ1', 'typ2') AND incMonth = Month, 1, 0 ) )AS
java - 如果直接从内存读取 volatile 字段，那么从哪里读取非 volatile 字段？
我最近读到 volatile 字段是线程安全的，因为 When we use volatile keyword with a variable, all the threads read its va
python - 在数据库中已有数据之后添加的 UUID 字段。有没有办法为现有数据填充 UUID 字段？
我在一些模型中添加了一个 UUID 字段，然后使用 South 进行了迁移。我创建的任何新对象都正确填充了 UUID 字段。但是，我所有旧数据的 UUID 字段为空。有没有办法为现有数据填充 UUI
php - 左连接中的两个表都有 id 字段。尝试从第一个数据库中提取 id 字段，但获取第二个数据库
刚刚将我的网站从 mysql_ 更新为 mysqli，并破坏了之前正常运行的查询。我试图从旋转中提取 id，因为它每次都会增加 1，但我不断获取玩家 id，有人可以告诉我我做错了什么吗？我尝试了将
mysql - 如何使用 MySQL 将一个表中的一列(字段)复制到另一个表的空列(字段)，这两个表都是同一数据库的一部分？
我在 Mac OS X 上使用带有 Sequel Pro 的 MySQL。我想将一个表中的一个字段(即名为“GAME_DY”的列)复制到另一个名为“DAY_ID”的表的空字段中。两个表都是同一数据库的
java - 为序列化设置一个 transient 字段，但为 JPA 设置非 transient 字段
问题: 是否有可能有一个字段被 JPA 保留但被序列化跳过？可以实现相反的效果(JPA 跳过字段而序列化则不会)，如果使用此功能，那么相反的操作肯定会很有用。类似这样的事情: @Entity cl
php - 无重复(分组依据)字段 1 循环，字段 2 位于水平线
假设我有一个名为“dp”的表 Year | Month | Payment| Payer_ID | Payment_Recipient | 2008/2009 | July
c - 我在 IP header 中找不到 DSCP 字段，只有已弃用的 TOS 字段
我将尝试通过我的 Raspberry Pi 接入点保证一些 QoS。开始之前，我先动手:我阅读了有关 tcp、udp 和 ip header 的内容。在IP header description我看
dart - 什么时候应该在 dart 中使用 final 字段、工厂构造函数或带有 getter 的私有(private)字段？
如果你能弄清楚如何重命名这个问题，我愿意接受建议。在 Dart 语言中，可以编写一个带有 final 字段的类。这些是只能设置的字段构造函数前 body 跑。这可以在声明中(通常用于类中的静态常量)
javascript - jquery:使用两个带有两个字段(字段 1、字段 2 + 1 天)的日期选择器，例如 booking.com
你怎么样？我有两个带有两个字段的日期选择器我希望当用户选择 (From) 时，第二个字段 (TO) 将是 next day 。比如 booking.com 例如:当用户选择From 01-01-2
mysql - 将字段从 T1 字段 A 复制到 T2 字段 A where(if or when) T1 field B = T2 field B (mysql)
我想我已经看到了这个问题的一些答案，这些答案可能与我需要的相差不远，但我对 mysql 的了解还不够确定，所以我会根据我的具体情况提出问题。我有一个包含多个表的数据库，为此，如果“image”表上的
mySQL在单个查询中多次使用相同的表/字段
我在 mySQL 数据库中有 2 个表: customers ============ customer_id (1, 2 ) customer_name (john, mark) orders ==
数据库归档与基于时间段的表/字段
我正在开发一个员工目标 Web 应用程序。领导/经理在与团队成员讨论后为他们设定目标。这是一年/半年/季度，具体取决于组织遵循的评估周期。现在的问题是添加基于时间段的字段或存档上一季度/年度数据的
Sitecore 字段，用于从媒体库中选择多个文件并能够上传文件
我正在寻找允许内容编辑器从媒体库中选择多个文件的东西，这些文件将在渲染中列出。他们还需要能够上传文件和搜索。它必须在页面编辑器(版本 8 中称为体验编辑器)中工作。到目前为止我所考虑的: 一堆文件字
r - 创建 "other"字段
现在，我有以下由 original.df %.% group_by(Category) %.% tally() %.% arrange(desc(n)) 创建的 data.frame。 DF 5),
潘塔霍。将登录的错误消息放入字符串/字段
我想知道是否有一些步骤/解决方案可以处理错误消息并将它们放入 Pentaho 工具中的某个字符串或字段中？例如，如果连接到数据库时发生某些错误，则将该消息从登录到字符串/字段。最佳答案我们在作业的
iPhone如何制作 "To"字段，如短信应用程序
如何制作像短信应用程序一样的“收件人”字段？例如，右侧有一个“+”按钮，当添加某人时，名称将突出显示并可单击，如圆角矩形等。有没有内置的框架？最佳答案不，但请参阅 Three20 的 TTMess
delphi - 列出记录的元素\字段
是否可以获取记录的元素或字段的列表通过类型信息类似于类的已发布属性的列表吗？谢谢！最佳答案取决于您的delphi版本，如果您使用的是delphi 2010或更高版本，则可以使用“新rtti”
带有外键列表的 SQLite 字段
我正在构建一个 SQLite 数据库来保存我的房地产经纪人的列表。我已经能够使用外键来识别每个代理的列表，但我想在每个代理的记录中创建一个列表；从代理商和列表之间的一对一关系转变为一对多关系。看这里

首页

博学

6Ren·AI

商城

MySQL 速度慢，表中有大文本字段