百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT技术 > 正文

技术分享 | 一招解决 MySQL 中 DDL 被阻塞的问题

wptr33 2025-02-11 13:45 30 浏览

作者:许祥

爱可生 MySQL DBA 团队成员,负责处理客户 MySQL 及我司自研 DMP 平台日常运维中的问题。

本文来源:原创投稿

* 爱可生开源社区出品,原创内容未经授权不得随意使用,转载请联系小编并注明来源。



背景

之前碰到客户咨询定位 DDL 阻塞的相关问题,整理了一下方法,如何解决 DDL 被阻塞的问题。下面,就这个问题,整理了一下思路:

  1. 怎么判断一个 DDL 是不是被阻塞了?
  2. 当 DDL 被阻塞时,怎么找出阻塞它的会话?

1. 如何判断一个 DDL 是不是被阻塞了?

测试过程如下:

mysql> use test;
Database changed

mysql> CREATE TABLE `test` (
-> `id` int() AUTO_INCREMENT PRIMARY KEY,
-> `name` varchar()
-> );
Query OK, 0 rows affected (0.01 sec)

# 插入数据
mysql> insert into test values (,'aaa'),(,'bbb'),(,'ccc'),(,'ddd');
Query OK, 1 row affected (0.01 sec)

mysql> begin;
Query OK, 0 rows affected (0.01 sec)


mysql> select * from test;
+----+------+
| id | name |
+----+------+
| 1 | aaa |
| 2 | bbb |
| 3 | ccc |
| 4 | ddd |
+----+------+
4 rows in set (0.00 sec)

# 模拟元数据锁阻塞
# 会话 1
mysql> lock tables test read;
Query OK, 0 rows affected (0.00 sec)

# 会话 2
mysql> alter table test add c1 varchar();
阻塞中

# 会话 3

mysql> show processlist;
+-------+-------------+---------------------+------+------------------+--------+---------------------------------------------------------------+-------------------------------------+
| Id | User | Host | db | Command | Time | State | Info |
+-------+-------------+---------------------+------+------------------+--------+---------------------------------------------------------------+-------------------------------------+
| 1 | universe_op | 127.0.0.1:28904 | | Sleep | 12 | | |
| 2 | universe_op | 127.0.0.1:28912 | | Sleep | 12 | | |
| 5752 | universe_op | 10.186.64.180:51808 | | Binlog Dump GTID | 605454 | Master has sent all binlog to slave; waiting for more updates | |
| 28452 | root | 10.186.65.110:10756 | test | Sleep | 73 | | |
| 28454 | root | 10.186.64.180:45674 | test | Query | 7 | Waiting for table metadata lock | alter table test add c1 varchar() |
| 28497 | root | 10.186.64.180:47026 | test | Query | 0 | starting | show processlist |
+-------+-------------+---------------------+------+------------------+--------+---------------------------------------------------------------+-------------------------------------+

DDL 一旦被阻塞了,后续针对该表的所有操作都会被阻塞,都会显示 Waiting for table metadata lock

上述情况的解决方案:Kill DDL 操作或 Kill 阻塞 DDL 的会话。

下面对于 DDL 的操作,我们需要获取元数据库锁的阶段有两个方面:DDL 开始之初和 DDL 结束之前。如果是后者,就意味着之前的操作都要回滚,成本相对较高。所以,碰到类似情况,我们一般都会 Kill 阻塞 DDL 的会话。

2. 怎么知道是哪些会话阻塞了DDL?


sys.schema_table_lock_waits
是 MySQL 5.7 引入的,用来定位 DDL 被阻塞的问题。

针对上面这个情况。可以查看
sys.schema_table_lock_waits
的输出。

mysql> select * from sys.schema_table_lock_waits\G
*************************** row ***************************
object_schema: test
object_name: test
waiting_thread_id: 28490
waiting_pid: 28454
waiting_account: root@10.186.64.180
waiting_lock_type: EXCLUSIVE
waiting_lock_duration: TRANSACTION
waiting_query: alter table test add c1 varchar()
waiting_query_secs: 179
waiting_query_rows_affected: 0
waiting_query_rows_examined: 0
blocking_thread_id: 28488
blocking_pid: 28452
blocking_account: root@10.186.65.110
blocking_lock_type: SHARED_READ_ONLY
blocking_lock_duration: TRANSACTION
sql_kill_blocking_query: KILL QUERY 28452
sql_kill_blocking_connection: KILL 28452
*************************** row ***************************
object_schema: test
object_name: test
waiting_thread_id: 28490
waiting_pid: 28454
waiting_account: root@10.186.64.180
waiting_lock_type: EXCLUSIVE
waiting_lock_duration: TRANSACTION
waiting_query: alter table test add c1 varchar()
waiting_query_secs: 179
waiting_query_rows_affected: 0
waiting_query_rows_examined: 0
blocking_thread_id: 28490
blocking_pid: 28454
blocking_account: root@10.186.64.180
blocking_lock_type: SHARED_UPGRADABLE
blocking_lock_duration: TRANSACTION
sql_kill_blocking_query: KILL QUERY 28454
sql_kill_blocking_connection: KILL 28454
rows in set (0.00 sec)

只有一个 alter 操作,却产生了两条记录,而且两条记录的 Kill 对象还不一样。如果对表结构不熟悉或不仔细看记录内容的话,难免会 Kill 错对象。

两条记录的 blocking_lock_type 类型分别为 SHARED_READ_ONLYSHARED_UPGRADABLE。我们需要 Kill 掉的是 SHARED_READ_ONLY

在 DDL 操作被阻塞后,如果后续有多个查询被 DDL 操作堵塞,还会产生 2N 多个条记录。

在定位问题时,这 2N 条记录看起来就比较难以定位了。这个时候,我们需要对上述 2N 条记录进行过滤。过滤的关键是 blocking_lock_type 不等于 SHARED_UPGRADABLE

SHARED_UPGRADABLE 是一个可升级的共享元数据锁,加锁期间,允许并发查询和更新。所以,阻塞 DDL 的不会是 SHARED_UPGRADABLE

针对上面这个场景,我们可以通过下面这个查询来精确地定位出需要 Kill 的会话。

mysql> SELECT sql_kill_blocking_connection FROM sys.schema_table_lock_waits WHERE blocking_lock_type <> 'SHARED_UPGRADABLE' AND waiting_query = 'alter table test add c1 varchar(25)';
+------------------------------+
| sql_kill_blocking_connection |
+------------------------------+
| KILL 28452 |
+------------------------------+
row in set (0.00 sec)

MySQL 5.7 中使用 sys.schema_table_lock_waits 的注意事项


sys.schema_table_lock_waits
视图依赖了一张 MDL 相关的表
performance_schema.metadata_locks
。该表是 MySQL 5.7 引入的,会显示 MDL 的相关信息,包括作用对象、锁的类型及锁的状态等。但在 MySQL 5.7 中,该表默认为空,因为与之相关的 instrument 默认没有开启,MySQL 8.0 才默认开启。

mysql> select * from performance_schema.setup_instruments where name='wait/lock/metadata/sql/mdl';
+----------------------------+---------+-------+
| NAME | ENABLED | TIMED |
+----------------------------+---------+-------+
| wait/lock/metadata/sql/mdl | NO | NO |
+----------------------------+---------+-------+
row in set (0.00 sec)

所以,在 MySQL 5.7 中,如果我们要使用
sys.schema_table_lock_waits
,必须首先开启 MDL 相关的 instrument。

开启方式: 直接修改
performance_schema.setup_instruments
表即可。具体 SQL 如下。

mysql> UPDATE PERFORMANCE_SCHEMA.setup_instruments SET ENABLED = 'YES', TIMED = 'YES' WHERE NAME = 'wait/lock/metadata/sql/mdl';

但这种方式是临时生效,实例重启后,又会恢复为默认值。

建议:同步修改配置文件或者在部署 MySQL 集群时一开始配置文件的参数就修改成功。

[mysqld]
performance-schema-instrument ='wait/lock/metadata/sql/mdl=ON'

总结

  1. 执行 show processlist,如果 DDL 的状态是 Waiting for table metadata lock ,则意味着这个 DDL 被阻塞了。
  2. 定位导致 DDL 被阻塞的会话,常用的方法如下:sys.schema_table_lock_waits
select sql_kill_blocking_connection from sys.schema_table_lock_waits WHERE blocking_lock_type <> 'SHARED_UPGRADABLE' and (waiting_query like 'alter%' OR waiting_query like 'create%' OR waiting_query like 'drop%' OR waiting_query like 'truncate%' OR waiting_query like 'rename%');

这种方法适用于 MySQL 5.7 和 8.0。

注意,MySQL 5.7 中,MDL 相关的 instrument 默认没有打开。

Kill DDL 之前的会话。

select concat('kill',i.trx_mysql_thread_id,';') from information_schema.innodb_trx i, ( select max(time) as max_time from information_schema.processlist where state = 'Waiting for table metadata lock' and (info like 'alter%' OR info like 'create%' OR info like 'drop%' OR info like 'truncate%' OR info like 'rename%')) p WHERE timestampdiff(second, i.trx_started ,now()) > p.max_time;

如果 MySQL 5.7 中 MDL 相关的 instrument 没有打开,可使用该方法。



本文关键字:#MySQL# #阻塞#

文章推荐:

故障分析 | MySQL 升级到 8.0 变慢问题分析

故障分析 | 一条本该记录到慢日志的 SQL 是如何被漏掉的

技术分享 | OceanBase写入限速源码解读

技术分享 | MySQL级联复制下进行大表的字段扩容



关于 SQLE

爱可生开源社区的 SQLE 是一款面向数据库使用者和管理者,支持多场景审核,支持标准化上线流程,原生支持 MySQL 审核且数据库类型可扩展的 SQL 审核工具。

SQLE 获取

类型地址
版本库https://github.com/actiontech/sqle
文档https://actiontech.github.io/sqle-docs-cn/
发布信息https://github.com/actiontech/sqle/releases
数据审核插件开发文档https://actiontech.github.io/sqle-docs-cn/3.modules/3.7_auditplugin/auditplugin_development.html

相关推荐

oracle数据导入导出_oracle数据导入导出工具

关于oracle的数据导入导出,这个功能的使用场景,一般是换服务环境,把原先的oracle数据导入到另外一台oracle数据库,或者导出备份使用。只不过oracle的导入导出命令不好记忆,稍稍有点复杂...

继续学习Python中的while true/break语句

上次讲到if语句的用法,大家在微信公众号问了小编很多问题,那么小编在这几种解决一下,1.else和elif是子模块,不能单独使用2.一个if语句中可以包括很多个elif语句,但结尾只能有一个else解...

python continue和break的区别_python中break语句和continue语句的区别

python中循环语句经常会使用continue和break,那么这2者的区别是?continue是跳出本次循环,进行下一次循环;break是跳出整个循环;例如:...

简单学Python——关键字6——break和continue

Python退出循环,有break语句和continue语句两种实现方式。break语句和continue语句的区别:break语句作用是终止循环。continue语句作用是跳出本轮循环,继续下一次循...

2-1,0基础学Python之 break退出循环、 continue继续循环 多重循

用for循环或者while循环时,如果要在循环体内直接退出循环,可以使用break语句。比如计算1至100的整数和,我们用while来实现:sum=0x=1whileTrue...

Python 中 break 和 continue 傻傻分不清

大家好啊,我是大田。今天分享一下break和continue在代码中的执行效果是什么,进一步区分出二者的区别。一、continue例1:当小明3岁时不打印年龄,其余年龄正常循环打印。可以看...

python中的流程控制语句:continue、break 和 return使用方法

Python中,continue、break和return是控制流程的关键语句,用于在循环或函数中提前退出或跳过某些操作。它们的用途和区别如下:1.continue(跳过当前循环的剩余部分,进...

L017:continue和break - 教程文案

continue和break在Python中,continue和break是用于控制循环(如for和while)执行流程的关键字,它们的作用如下:1.continue:跳过当前迭代,...

作为前端开发者,你都经历过怎样的面试?

已经裸辞1个月了,最近开始投简历找工作,遇到各种各样的面试,今天分享一下。其实在职的时候也做过面试官,面试官时,感觉自己问的问题很难区分候选人的能力,最好的办法就是看看候选人的github上的代码仓库...

面试被问 const 是否不可变?这样回答才显功底

作为前端开发者,我在学习ES6特性时,总被const的"善变"搞得一头雾水——为什么用const声明的数组还能push元素?为什么基本类型赋值就会报错?直到翻遍MDN文档、对着内存图反...

2023金九银十必看前端面试题!2w字精品!

导文2023金九银十必看前端面试题!金九银十黄金期来了想要跳槽的小伙伴快来看啊CSS1.请解释CSS的盒模型是什么,并描述其组成部分。答案:CSS的盒模型是用于布局和定位元素的概念。它由内容区域...

前端面试总结_前端面试题整理

记得当时大二的时候,看到实验室的学长学姐忙于各种春招,有些收获了大厂offer,有些还在苦苦面试,其实那时候的心里还蛮忐忑的,不知道自己大三的时候会是什么样的一个水平,所以从19年的寒假放完,大二下学...

由浅入深,66条JavaScript面试知识点(七)

作者:JakeZhang转发链接:https://juejin.im/post/5ef8377f6fb9a07e693a6061目录由浅入深,66条JavaScript面试知识点(一)由浅入深,66...

2024前端面试真题之—VUE篇_前端面试题vue2020及答案

添加图片注释,不超过140字(可选)1.vue的生命周期有哪些及每个生命周期做了什么?beforeCreate是newVue()之后触发的第一个钩子,在当前阶段data、methods、com...

今年最常见的前端面试题,你会做几道?

在面试或招聘前端开发人员时,期望、现实和需求之间总是存在着巨大差距。面试其实是一个交流想法的地方,挑战人们的思考方式,并客观地分析给定的问题。可以通过面试了解人们如何做出决策,了解一个人对技术和解决问...