细说MySQL死锁与日志二三事-6ren

细说MySQL死锁与日志二三事

转载作者：qq735679552 更新时间：2022-09-29 22:32:09

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章细说MySQL死锁与日志二三事由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

最近线上 MySQL 接连发生了几起数据异常，都是在凌晨爆发，由于业务场景属于典型的数据仓库型应用，白天压力较小无法复现。甚至有些异常还比较诡异，最后 root cause 分析颇费周折。那实际业务当中咱们如何能快速的定位线上 MySQL 问题，修复异常呢？下文我会根据两个实际 case，分享下相关的经验与方法.

Case1：部分数据更新失败。

某天渠道同学反馈某报表极个别渠道数据为 0，大部分渠道数据正常。这个数据是由一个统计程序每天凌晨例行更新的，按理来说，要么全部正常，要么全部失败，那会是什么原因导致极个别数据异常呢?

首先我们能想到的自然是根据统计任务日志来看了，但是看了统计程序打印的日志没有发现诸如 SQL update 失败的异常描述，那当时的数据库究竟发生了什么呢？在查看 MySQL-server 日志之前，习惯性的看了下数据库状态:

细说MySQL死锁与日志二三事

恰好看到了凌晨这个 update 发生了死锁:

细说MySQL死锁与日志二三事

篇幅所限，上下文我这里省略了很多，从这段日志里可以看到，TRANSACTION 1 和 TRANSACTION 2 分别持有一定数量的行锁，然后又等待对方的锁，最后 MySQL 检测到 deadlock ，然后选择回滚了 TRANSACTION 1：Innodb目前处理死锁的方法是将持有最少行级排他锁的事务进行回滚.

那这里就有 3 个问题了:

1、innodb 行锁不是只锁一行?

因为这张表是 innodb 引擎的，InnoDB 支持行锁和表锁。而InnoDB行锁是通过给索引上的索引项加锁来实现的，这一点MySQL与Oracle不同，后者是通过在数据块中对相应数据行加锁来实现的。InnoDB这种行锁实现特点意味着：只有通过索引条件检索数据，InnoDB才使用行级锁，否则，InnoDB将使用表锁，会把所有扫描过的行都锁定！在实际应用中，要特别注意InnoDB行锁的这一特性，不然的话，可能导致大量的锁冲突，从而影响并发性能。由于MySQL的行锁是针对索引加的锁，不是针对记录加的锁，所以虽然是访问不同行的记录，但是如果是使用相同的索引键，是会出现锁冲突的。当我们用范围条件而不是相等条件检索数据，并请求共享或排他锁时，InnoDB会给符合条件的已有数据记录的索引项加锁；另外间隙锁也会锁多行，InnoDB除了通过范围条件加锁时使用间隙锁外，如果使用相等条件请求给一个不存在的记录加锁，InnoDB也会使用间隙锁！。

话都说到这了，那就看下咱们业务表的索引情况:

细说MySQL死锁与日志二三事

可以看到这张表的索引极不合理：有3个索引，但是 update 却没有完全的用上索引，导致 update 没有精确的用上索引，需要锁定多行范围数据，从而引发死锁.

知道原理后，咱们再精心构建一个四字段的组合索引即可让 update 精准的走 innodb 索引，实际上，我们更新索引后，这个死锁问题即得到了解决.

注：innodb不仅会打印出事务和事务持有和等待的锁，而且还有记录本身，不幸的是，它可能超过innodb为输出结果预留的长度（只能打印1M的内容且只能保留最近一次的死锁信息），如果你无法看到完整的输出，此时可以在任意库下创建innodb_monitor或innodb_lock_monitor表，这样innodb status信息会完整且每15s一次被记录到错误日志中。如：create table innodb_monitor(a int)engine=innodb;，不需要记录到错误日志中时就删掉这个表即可.

2、回滚为什么只有部分 update 语句失败。

回滚的话，为什么只有部分 update 语句失败，而不是整个事务里的所有 update 都失败?

这是因为咱们的 innodb 默认是自动提交的:

细说MySQL死锁与日志二三事

在多个 update 或 insert 语句情况下，每执行完一条 SQL，innodb 就立即 commit 一次以持久化变更，同时释放锁，这也正是本例中死锁回滚事务后只有极个别语句失败的原因.

需要注意的是，通常还有另外一种情况也可能导致部分语句回滚，需要格外留意。在 innodb 里有个参数叫：innodb_rollback_on_timeout 。

细说MySQL死锁与日志二三事

官方手册里这样描述:

In MySQL 5.1, InnoDB rolls back only the last statement on a transaction timeout by default. If –innodb_rollback_on_timeout is specified, a transaction timeout causes InnoDB to abort and roll back the entire transaction (the same behavior as in MySQL 4.1). This variable was added in MySQL 5.1.15. 。

解释：这个参数关闭或不存在的话遇到超时只回滚事务最后一个Query，打开的话事务遇到超时就回滚整个事务.

3、怎样降低 innodb 死锁几率?

死锁在行锁及事务场景下很难完全消除，但可以通过表设计和SQL调整等措施减少锁冲突和死锁，包括:

尽量使用较低的隔离级别，比如如果发生了间隙锁，你可以把会话或者事务的事务隔离级别更改为 RC(read committed)级别来避免，但此时需要把 binlog_format 设置成 row 或者 mixed 格式。

精心设计索引，并尽量使用索引访问数据，使加锁更精确，从而减少锁冲突的机会；。

选择合理的事务大小，小事务发生锁冲突的几率也更小；。

给记录集显示加锁时，最好一次性请求足够级别的锁。比如要修改数据的话，最好直接申请排他锁，而不是先申请共享锁，修改时再请求排他锁，这样容易产生死锁；。

不同的程序访问一组表时，应尽量约定以相同的顺序访问各表，对一个表而言，尽可能以固定的顺序存取表中的行。这样可以大大减少死锁的机会；。

尽量用相等条件访问数据，这样可以避免间隙锁对并发插入的影响；。

不要申请超过实际需要的锁级别；除非必须，查询时不要显示加锁；。

对于一些特定的事务，可以使用表锁来提高处理速度或减少死锁的可能.

Case2：诡异的 Lock wait timeout 。

连续几天凌晨6点和早上8点都分别有一个任务失败，load data local infile 的时候报 Lock wait timeout exceeded try restarting transaction innodb 的 Java SQL 异常，和平台的同学沟通得知，这是我们自己的业务数据库的 Lock 时间太短或者锁冲突的问题。但是回头一想不应该啊？这不一直好好的吗？而且基本都是单表单任务，不存在多人冲突.

甭管谁的问题，那咱们还是先看自己的数据库有没有问题:

细说MySQL死锁与日志二三事

默认 lock 超时时间 50s，这个时间真心不短了，估计调了也没用，事实上确实死马当活马医的试了下没用。。.

而且这次 SHOW ENGINE INNODB STATUS\G 也没出现任何死锁信息，然后又将目光转向 MySQL-server 日志，希望能从日志里看一看那个时刻前后数据究竟在做什么操作。这里先简单的介绍下MySQL日志文件系统的组成:

(a) error 日志：记录启动、运行或停止 mysqld 时出现的问题，默认开启。 (b) general 日志：通用查询日志，记录所有语句和指令，开启数据库会有 5% 左右性能损失。 (c) binlog 日志：二进制格式，记录所有更改数据的语句，主要用于 slave 复制和数据恢复。 (d) slow 日志：记录所有执行时间超过 long_query_time 秒的查询或不使用索引的查询，默认关闭。 (e) Innodb日志：innodb redo log、undo log，用于恢复数据和撤销操作.

从上面的介绍可以看到，目前这个问题的日志可能在 d 和 b 中，看了下 d 中没有，那就只能开启 b 了，但 b 对数据库的性能有一定损耗，由于是全量日志，量非常巨大，所以开启一定要谨慎:

细说MySQL死锁与日志二三事

我这里只是每天在出问题的前后半小时开启下全量日志，结果没有发现任何 MySQL-client 请求到我们的业务数据库！该日志格式如下，记录了所有的连接与命令:

细说MySQL死锁与日志二三事

那问题基本确定了，客户端请求都没到我们这边就抛出了上述的异常，和平台方再三沟通确认下，最后平台方查证是因为在执行插入前他们需要先从 SQL task 表取出 SQL 和更新 task 状态，结果这张表由于在整点存在大量 insert 和 update 并发，导致部分 SQL 等待 lock 超时了。。.

MySQL 日志分析脚本。

由于凌晨是数据仓库的业务高峰，很多问题都是在这个时候爆发，一些诡异的问题往往是过了这个村就没这个店了，白天无法复现。如何能捕获我们关心的日志，便于快速的定位问题，这个是重中之重，这里我写了个小脚本，crontab 部署，可以选择时间范围开启，每分钟采样一次日志，需要说明的是 general log 没事别轻易开启，否则对数据库性能损耗较大.

细说MySQL死锁与日志二三事

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持我.

最后此篇关于细说MySQL死锁与日志二三事的文章就讲到这里了,如果你想了解更多关于细说MySQL死锁与日志二三事的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

文章推荐： MySQL批量SQL插入性能优化详解

文章推荐： magento后台无法登录解决办法的两种方法

文章推荐： Zend Framework常用校验器详解

文章推荐：解决“无法启动mysql服务错误1069”的方法

Java并发多线程编程——锁
一、公平锁和非公平锁 1.1、公平锁和非公平锁的概述公平锁：指多个线程按照申请锁的顺序来获取锁。非公平锁：指在多线程获取锁的顺序并不是按照申请锁的顺序，有可能后申请的线程比先申请的线程优先获取到锁
MySQL高级9-锁
阅读目录 1、简介 2、分类 3、全局锁 4、表级锁 5、表锁 6、元数据锁
concurrency - 锁/条件变量问题
因此，在我编写的程序中，我有三个函数，为了简单起见，我们将它们称为 A、B 和 C。每个函数都需要访问资源X才能工作。限制是A和B不允许同时运行并且必须适当同步。但是，C 可以与 A 或 B 同时运
concurrency - 锁、互斥量和信号量有什么区别？
我听说过这些与并发编程相关的词，但是锁、互斥量和信号量之间有什么区别？最佳答案锁只允许一个线程进入被锁定的部分，并且该锁不与任何其他进程共享。互斥锁与锁相同，但它可以是系统范围的(由多个进程共享
java - 线程安全单例、锁
这个问题已经有答案了: What is an efficient way to implement a singleton pattern in Java? [closed] (29 个回答) 已关闭
java - 线程安全单例、锁
这个问题已经有答案了: What is an efficient way to implement a singleton pattern in Java? [closed] (29 个回答) 已关闭
事务、锁、隔离级别
我对标题中的主题有几个问题。首先，假设我们使用 JDBC，并且有 2 个事务 T1 和 T2。在 T1 中，我们在一个特定的行上执行 select 语句。然后我们对该行执行更新。在事务 T2 中，我们
MySql:如何在存储过程中使用互斥锁/锁
我希望我的函数只运行一次。这意味着如果多个线程同时调用它，该函数将阻塞所有线程，只允许它运行。最佳答案听起来您希望存储过程进行同步。为什么不直接将同步放在应用程序本身中。 pthread_mute
C# 锁(this)方法
if (runInDemoMode) { lock (this) { //Initalization of tables dCreator.create
java - 挑剔的主机(锁？)
我相信无论使用什么语言都可以考虑我的问题，但是为了有一些“ anchor ”，我将使用 Java 语言来描述它。让我们考虑以下场景:我有一个扩展 Thread 的类 PickyHost 及其实例 p
JavaScript、异步、锁？
我知道异步不是并行的，但我现在遇到了一个非常有趣的情况。 async function magic(){ /* some processing here */ await async () =
java - 在未来的代码中使用同步/锁
我们正在使用 Scala、Play 框架和 MongoDB(以 ReactiveMongo 作为我们的驱动程序)构建一个网络应用程序。应用程序架构是端到端的非阻塞。在我们代码的某些部分，我们需要访问
java - JavaME 锁
我需要一个简单的锁，JavaME 超时(concurrent.lock 的反向移植需要完整的 Java 1.3)。如果其他人已经为 JavaME 发布了经过测试的锁定代码，我宁愿使用它。锁定是出了
c++ - 锁()的实现
根据 boost : To access the object, a weak_ptr can be converted to a shared_ptr using the shared_ptr co
c++ - 锁、互斥和临界区之间的区别
关于 Mutex 和 Critical 部分之间的区别存在一个问题，但它也不处理 Locks。所以我想知道临界区是否可以用于进程之间的线程同步。还有信号状态和非信号状态的含义最佳答案在 Win
c#.NET高级编程高并发必备技巧-锁
锁最为常见的应用就是高并发的情况下，库存的控制。本次只做简单的单机锁介绍。直接看代码：每请求一次库存-1. 假如库存1000，在1000个人请求之后，库存将变为0。
详解python多线程、锁、event事件机制的简单使用
线程和进程 1、线程共享创建它的进程的地址空间,进程有自己的地址空间 2、线程可以访问进程所有的数据，线程可以相互访问 3、线程之间的数据是独立的 4、子进程复制线程的数据 5、子进程启动
这把“锁”不简单，让你畅游数字世界
**摘要：**细心的你也一定关注到，有的网址是https开头的，有的是http。https开头的网站前面，会有一把小锁。这是为什么呢？本文分享自华为云社区《还不知道SSL证书已经是刚需了？赶快来了解
c - 互斥量(锁)的所有权是如何实现的？
试图在 C 中实现一个非常简单的互斥锁(锁)我有点困惑。我知道互斥锁类似于二进制信号量，除了互斥锁还强制执行释放锁的线程的约束，必须是最近获得它的同一线程。我对如何跟踪所有权感到困惑？这是我到目前为
SQL Server 锁 - 避免插入重复条目
在阅读了很多与上述主题相关的文章和答案之后，我仍然想知道 SQL Server 数据库引擎在以下示例中是如何工作的: 假设我们有一个名为 t3 的表: create table t3 (a int ,

qq735679552

个人简介

我是一名优秀的程序员,十分优秀！

作者热门文章

滴滴打车优惠券免费领取

全站热门文章

首页

博学

6Ren·AI

商城

细说MySQL死锁与日志二三事