大表上的 MySQL 存储过程占用服务器磁盘空间-6ren

大表上的 MySQL 存储过程占用服务器磁盘空间

转载作者：行者123 更新时间：2023-11-29 06:35:29

24

4

我继承了一个大约有 5 亿行的 MySQL InnoDB 表。该表包含 IP 编号和该编号所属的 ISP 的名称，均为字符串形式。

有时，在公司发生变化(例如合并或更名)后，我需要将 ISP 的名称更新为新值。但是，由于表太大，简单的 UPDATE...WHERE 语句不起作用 - 查询通常会超时，或者框内存不足。

因此，我编写了一个存储过程，它使用游标尝试一次更改一条记录。当我在一个小样本表上运行该过程时，它运行良好。但是，当我尝试针对生产中的整个 5 亿行表运行它时，我可以看到创建了一个临时表(因为出现了/tmp/xxx.MYI 和/tmp/xxx.MYD 文件)。临时表文件的大小不断增加，直到用完盒子上的所有可用磁盘空间(大约 40 GB)。

我不确定为什么需要这个临时表。服务器是否试图维护某种回滚状态？我真正的问题是，我可以更改存储过程以便不创建临时表吗？我真的不在乎是否有一些记录得到更新，但不是所有记录都得到更新 - 我可以轻松添加一些报告并继续运行过程，直到没有记录被更改。

此时，架构更改并不是一个真正的选择——例如，我无法更改表的结构。

在此先感谢您的帮助。

大卫

这是我的存储过程；

DELIMITER $$

DROP PROCEDURE IF EXISTS update_isp;
CREATE PROCEDURE update_isp()
BEGIN
  DECLARE v_finished INT DEFAULT 0;
  DECLARE v_num      VARCHAR(255) DEFAULT "";
  DECLARE v_isp      VARCHAR(255) DEFAULT "";

  DECLARE ip_cursor CURSOR FOR
    SELECT ip_number, isp FROM ips;

  DECLARE CONTINUE HANDLER
    FOR NOT FOUND SET v_finished = 1;

  OPEN ip_cursor;

  get_ip: LOOP
    IF v_finished = 1 THEN
      LEAVE get_ip;
    END IF;

    FETCH ip_cursor INTO v_num, v_isp;

    IF v_isp = 'old name' THEN
      UPDATE ips SET isp = 'new name' WHERE ip_number = v_num;
    END IF;
  END LOOP get_ip;
  CLOSE ip_cursor;
END$$

DELIMITER ;

CALL update_isp();

我也试过将更新语句包装在事务中。这没有任何区别。

[编辑] 我下面的假设是错误的，即简单的计数过程不会创建临时表。临时表仍会创建，但它增长得更慢，并且在该过程完成之前该框不会用完磁盘空间。

所以问题似乎是在存储过程中对游标的任何使用都会导致创建临时表。我不知道为什么，也不知道是否有任何方法可以防止这种情况发生。

最佳答案

如果您的更新本质上是:

UPDATE ips
    SET isp = 'new name'
     WHERE isp = OLDNAME;

我猜测如果您在 isp(isp) 上有索引，这个没有光标的 update 会工作得更好:

create index idx_isp_isp on isp(isp);

创建此索引后，您的原始查询应该没问题。即使在非常大的表中更新单行也不应该有性能问题。问题很可能是找到该行，而不是更新它。

关于大表上的 MySQL 存储过程占用服务器磁盘空间，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/25158770/

24

4

0

文章推荐： java - 返回对数组的引用是什么意思？

文章推荐： php - BindValue 不接受假值

文章推荐： java - 使用哪种布局以及如何使用？

文章推荐： mysql - 连接两个表，其条件为 "ON"

java - 服务器启动后将Ehcache的缓存数据写入本地文件(磁盘)，重新启动时应从文件(磁盘)中获取数据
我在服务器启动时创建一个缓存(服务器启动每次都需要10分钟)。目前我正在使用内存缓存(Ehcache)。现在我想建立一个机制，以便一旦数据被缓存我应该能够在几秒钟内启动服务器。比如将缓存的持久副本写入
JSON 磁盘/内存大小比率
我编写 json 结构的方式使得文件(在进行了一个月的测量后)存储在磁盘上时仍然只有 100 MB 左右。但是现在文件大约是 20mb，但我看到我的脚本需要的内存大约是 200/300 mb。显然，脚
solaris挂载windows fat32 磁盘
Solaris9 x86下如何挂载和永久挂载windows fat32分区临时挂载Shell 命令; mout –F pcfs /dev/dsk/c1d0p0:c /mnt/c mount
azure - 磁盘 ID 中的资源组名称不区分大小写
磁盘ID中的资源组名称大小写不敏感。重现此问题的步骤 - 在 Azure 中创建独立磁盘，检查 ID。对于例如 -“/subscriptions/subscriptionID/resourceGrou
azure - 磁盘 UUID 在哪个命名空间中是唯一的？
我已将附加数据磁盘的备份还原到新虚拟机。当我发出命令 sudo blkid 时，我发现它与附加到原始虚拟机的数据磁盘具有相同的 UUID，因此我无需更改 fstab 即可在启动时挂载它。然而，它似乎是
assembly - 磁盘 IO 操作在内核级程序集中通常如何看待？
在用户态中，执行磁盘 IO 就像链接 C 库一样简单，或者，如果您喜欢冒险，可以直接执行系统调用。我想知道内核本身是如何执行 IO 的。换句话说，假设我在裸机上以特权模式运行应用程序。我将如何访问通
azure - 磁盘 UUID 在哪个命名空间中是唯一的？
我已将附加数据磁盘的备份还原到新虚拟机。当我发出命令 sudo blkid 时，我发现它与附加到原始虚拟机的数据磁盘具有相同的 UUID，因此我无需更改 fstab 即可在启动时挂载它。然而，它似乎是
laravel - 磁盘 [视频] 没有配置的驱动程序
我正在尝试使用 laravel 和 ffmpeg 创建缩略图。但是我收到了这个错误。磁盘 [视频] 没有配置驱动程序。我的代码 public function index() { FFMp
c++ - 如何像winhex一样直接读/写usb(磁盘)？
我的目标是读/写 usb。首先必须打开并读取 usb 低级别，如“程序” 我使用 visual c++ 和 winAPI 下面是我的测试代码 char path[64]; sprintf(path,
c - 磁盘 I/O 的内核缓冲区缓存何时为空？
内核缓冲区缓存何时为空？这似乎不是 LINE Buffering。如果我写 () 一个没有换行符的字符串，它会立即输出到文件。另外，socket文件的输入输出缓冲区是否也像Disk I/O一样使用内
linux - 使用命令加载 RAM 磁盘
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。这个问题似乎不是关于 a specific programming problem, a software
linux - 磁盘 I/O 基准测试
我有一个大型调用中心，有 250 个并发调用。队列日志的队列应用程序平面文件。该系统使用 Asterisk 和 Queuemetrics。两个服务都在同一台服务器上运行。规范为 16 核和 64 GB
Centos 磁盘 LVM 扩展
我在使用安装了 Centos7 的 VMWare VM 时遇到问题。 lsblk 命令给出如下内容 df -h 给出这个我正在尝试将 root lvm 扩展到分区，但无论我如何尝试都无法做到这一点。
java - 磁盘 I/O 算法的运行时间
在基于内存的计算模型中，通过考虑数据结构，可以抽象地完成唯一需要进行的运行时计算。但是，关于高性能磁盘 I/O 算法的文档并不多。因此，我提出了以下一组问题: 1) 我们如何估计磁盘 I/O 操作的
windows - 如何以编程方式创建 RAM 磁盘？
我不是在寻找调用命令行实用程序的代码，它可以解决问题。我实际上很想知道用于创建 RAM 磁盘的 API。编辑动机:我有一个第三方库，它需要一个目录名，以便以某种方式处理该目录中的文件。我将这些文件
mysql 磁盘 I/O 100%
MySQL 数据库显示磁盘 I/O 利用率持续保持在 100% 左右。数据库服务器有 24 GB 内存。我们尝试优化查询，但效果不佳。请检查如下所示的当前配置参数: 参数当前值 key_buff
database - 组合缓存方法 - 基于内存缓存/磁盘
这是交易。我们本可以采用完全静态 html 的方式来解决性能问题，但由于该站点将是部分动态的，因此这对我们来说行不通。我们想到的是使用 memcache + eAccelerator 来加速 PHP
c# - 内存映射文件与 RAM 磁盘
对于游戏 Minecraft，运行服务器应用程序时的一般方法是在 RAMDisk 中运行它，因为它使用数百个小文件来生成世界，I/O 速度是主要瓶颈。在最近的尝试中，我尝试使用 Dokan/ImDi
c - 磁盘 I/O 期间幕后发生了什么？
当我查找文件中的某个位置并写入少量数据(20 字节)时，幕后发生了什么？我的理解据我所知，可以从磁盘写入或读取的最小数据单位是一个扇区(传统上是 512 字节，但该标准现在正在改变)。这意味着要写
go - 如何使用golang获取xen服务器内存、磁盘、网络和CPU信息？
如何使用golang获取xen服务器的内存、磁盘、网络和cpu信息？是否有任何可用的软件包？最佳答案与其他服务器有什么不同？如果没有 - 有一堆 Go 包可以做到这一点，我正在使用这个 - ht

首页

博学

6Ren·AI

商城

大表上的 MySQL 存储过程占用服务器磁盘空间