[MySQL]可重复读下的幻读

2024-02-22 21:30

本文主要是介绍[MySQL]可重复读下的幻读,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

一、幻读的定义

        根据MySQL官网的描述,幻读是“相同的查询在不同时间返回了不同的结果

        The so-called phantom problem occurs within a transaction when the same query produces different sets of rows at different times.

         同时官网还举例说明了,如:两次查询中,后一次多出来的行就是所谓的“幻影行”

         For example, if a SELECT is executed twice, but returns a row the second time that was not returned the first time, the row is a “phantom” row.

        了解Innodb的同学应该十分眼熟下面这张图,图里介绍了各个隔离级别下的一致性问题。

图片来源:数据库系统原理

        得益于MVCC机制,可重复读级别(RR)下依赖一份不更新的Read View使之后提交事务的修改对当前事务不可见,解决了脏读和不可重复读问题。

read view形如 [m_up_limit_id, m_low_limit_id] 的数组,记录了当前活跃的事务

        不知你是否会和我有一样的疑问:

        “既然RR实现了可重复读,按理已经屏蔽了其他事务的修改。但为什么还是会受其他事务影响产生幻读的问题?”

        “RR下幻读是否真实存在?”

        “幻读到底长什么样?”

        如果你也和我一样有上述疑问,很好!接下来我们将一起探寻幻读的真相。

二、寻找幻读

        秉持着“先问是不是,再问为什么”的理念,我们得先证明幻读在RR下是存在的。

        为了制造幻读,先简单准备了一张'test_lock'表:

SET NAMES utf8mb4;
SET FOREIGN_KEY_CHECKS = 0;-- ----------------------------
-- Table structure for test_lock
-- ----------------------------
DROP TABLE IF EXISTS `test_lock`;
CREATE TABLE `test_lock`  (`id` int(11) NOT NULL AUTO_INCREMENT,`a` int(11) NOT NULL,`b` int(11) NOT NULL,PRIMARY KEY (`id`) USING BTREE,INDEX `a`(`a`) USING BTREE
) ENGINE = InnoDB AUTO_INCREMENT = 26 CHARACTER SET = utf8mb4 COLLATE = utf8mb4_general_ci ROW_FORMAT = Dynamic;-- ----------------------------
-- Records of test_lock
-- ----------------------------
INSERT INTO `test_lock` VALUES (1, 1, 1);
INSERT INTO `test_lock` VALUES (5, 5, 5);
INSERT INTO `test_lock` VALUES (10, 10, 10);
INSERT INTO `test_lock` VALUES (15, 15, 15);SET FOREIGN_KEY_CHECKS = 1;
test_lock

        确认RR隔离级别后,开始编写事务, 着手制造幻读:

事务A事务B
1begin;
2SELECT * FROM `test_lock` WHERE a<10;
3begin;
4INSERT INTO test_lock VALUES(6,6,6);
5

commit;

6(待输入)

        在“待输入”处应该要执行什么语句才能复现幻读呢?尝试执行select for update:

SELECT * FROM `test_lock` WHERE a<10 for UPDATE;

        使用当前读(Locking Read)确实看到了刚刚插入的 (6, 6, 6) ,但这是幻读吗?

        根据官方的定义,幻读发生在相同的查询,返回不同的结果。

        实验中 select 和 select for update ,一个是快照读(Consistent Nonlocking Reads),一个是当前读(Locking Read),明显不符合“same query”的要求

        那既然select for update已经能看到插入了,在后面再执行一遍原来的快照读,是否就能符合要求了呢?

事务A事务B
1begin;
2SELECT * FROM `test_lock` WHERE a<10;
3begin;
4INSERT INTO test_lock VALUES(6,6,6);
5

commit;

6SELECT * FROM `test_lock` WHERE a<10 for UPDATE;
7SELECT * FROM `test_lock` WHERE a<10;
select for update
select

        神奇的现象发生了,在select for update中可见的 (6, 6, 6) 又不见了

        这样一来,虽然满足了“same query”的要求,但又不满足“different sets of rows”了

        要想理解刚刚这种现象,需要回到RR的本质————“不更新的Read View

  • 前后两次快照读,因为Read View没有更新,所以没有任何差别

  • 当前读使用了最新的Read View,看见了插入,但并没有更新事务里的read view副本。

        至此,这种忽隐忽现的“伪幻读”已经解释清楚了。

三、发现幻读

        既然RR下的Read View是不更新的,那事务A要如何看到事务B的插入呢?

        进行两次当前读?很明显不行,由于间隙锁(Gap Lock)的存在,事务B无法在事务A锁定的区间进行插入。插入都被阻塞了,还谈什么返回结果不同。

        那还有别的办法吗?有!

        这次我们成功地看到了幻读的发生,同时符合相同查询相同结果两个定义。

        根据MySQL执行修改的流程,事务A在执行修改时,先使用当前读将数据读入缓冲池(Buffer Pool),再将修改应用到内存。

图片来源:update在MySQL中是怎样执行的,一张图牢记

         正是这样的先加载后更新的操作,让事务A看到自身更新的同时,也看到了事务B的插入,导致幻读发生。

四、解决幻读

        幻读发生的条件较为苛刻,多数情况下是触发不了的。

        但如果发生,我们可以使用当前读对区间上间隙锁,阻塞插入的发生,从而规避幻读。

        还记得刚刚讨论方案时说的吗,用的就是这种方法:

        既然RR下的Read View是不更新的,那事务A要如何看到事务B的插入呢?

        进行两次当前读?很明显不行,由于间隙锁(Gap Lock)的存在,事务B无法在事务A锁定的区间进行插入。插入都被阻塞了,还谈什么返回结果不同。

        具体上锁的方式分为两种:

  • SELECT ... FOR SHARE
  • SELECT ... FOR UPDATE

        根据检索条件和具体行数据的不同,间隙锁可能与行锁(Record Lock)结合,生成临键锁(Next Key Lock)。与间隙锁一样,生成的临键锁也可阻塞其他事务的修改。三者的关系为:

  • 行锁:对唯一索引进行等值查询且命中
  • 间隙锁:进行等值查询未命中
  • 临键锁:(剩余查询条件)

        需要注意的是,间隙锁是种特殊的锁,相同的间隙锁是共享的,并不是互斥的。 

        这种共享将可能导致死锁的发生,如:

事务A事务B
1begin;
2SELECT * FROM `test_lock` WHERE a=3 FOR UPDATE;
3# 锁定区间(1, 5)
4begin;
5SELECT * FROM `test_lock` WHERE a=4 FOR UPDATE;
6# 锁定区间(1, 5)
7INSERT INTO test_lock VALUES(3, 3, 3);
8# 发生阻塞,等待事务B释放间隙锁
9INSERT INTO test_lock VALUES(4, 4, 4);
10# 发生死锁
死锁事务B自动中断并报错

五、总结

        至此,我们给出了幻读的定义、重现了幻读、提供了解决方案、讨论了死锁的条件。

        RR下存在幻读,可以使用间隙锁避免

参考:

MySQL 8.0 Reference Manual

Innodb MVCC源码实现—— xpchild

这篇关于[MySQL]可重复读下的幻读的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/736551

相关文章

SQL中的外键约束

外键约束用于表示两张表中的指标连接关系。外键约束的作用主要有以下三点: 1.确保子表中的某个字段(外键)只能引用父表中的有效记录2.主表中的列被删除时,子表中的关联列也会被删除3.主表中的列更新时,子表中的关联元素也会被更新 子表中的元素指向主表 以下是一个外键约束的实例展示

基于MySQL Binlog的Elasticsearch数据同步实践

一、为什么要做 随着马蜂窝的逐渐发展,我们的业务数据越来越多,单纯使用 MySQL 已经不能满足我们的数据查询需求,例如对于商品、订单等数据的多维度检索。 使用 Elasticsearch 存储业务数据可以很好的解决我们业务中的搜索需求。而数据进行异构存储后,随之而来的就是数据同步的问题。 二、现有方法及问题 对于数据同步,我们目前的解决方案是建立数据中间表。把需要检索的业务数据,统一放到一张M

如何去写一手好SQL

MySQL性能 最大数据量 抛开数据量和并发数,谈性能都是耍流氓。MySQL没有限制单表最大记录数,它取决于操作系统对文件大小的限制。 《阿里巴巴Java开发手册》提出单表行数超过500万行或者单表容量超过2GB,才推荐分库分表。性能由综合因素决定,抛开业务复杂度,影响程度依次是硬件配置、MySQL配置、数据表设计、索引优化。500万这个值仅供参考,并非铁律。 博主曾经操作过超过4亿行数据

性能分析之MySQL索引实战案例

文章目录 一、前言二、准备三、MySQL索引优化四、MySQL 索引知识回顾五、总结 一、前言 在上一讲性能工具之 JProfiler 简单登录案例分析实战中已经发现SQL没有建立索引问题,本文将一起从代码层去分析为什么没有建立索引? 开源ERP项目地址:https://gitee.com/jishenghua/JSH_ERP 二、准备 打开IDEA找到登录请求资源路径位置

MySQL数据库宕机,启动不起来,教你一招搞定!

作者介绍:老苏,10余年DBA工作运维经验,擅长Oracle、MySQL、PG、Mongodb数据库运维(如安装迁移,性能优化、故障应急处理等)公众号:老苏畅谈运维欢迎关注本人公众号,更多精彩与您分享。 MySQL数据库宕机,数据页损坏问题,启动不起来,该如何排查和解决,本文将为你说明具体的排查过程。 查看MySQL error日志 查看 MySQL error日志,排查哪个表(表空间

poj2406(连续重复子串)

题意:判断串s是不是str^n,求str的最大长度。 解题思路:kmp可解,后缀数组的倍增算法超时。next[i]表示在第i位匹配失败后,自动跳转到next[i],所以1到next[n]这个串 等于 n-next[n]+1到n这个串。 代码如下; #include<iostream>#include<algorithm>#include<stdio.h>#include<math.

poj3261(可重复k次的最长子串)

题意:可重复k次的最长子串 解题思路:求所有区间[x,x+k-1]中的最小值的最大值。求sa时间复杂度Nlog(N),求最值时间复杂度N*N,但实际复杂度很低。题目数据也比较水,不然估计过不了。 代码入下: #include<iostream>#include<algorithm>#include<stdio.h>#include<math.h>#include<cstring

MySQL高性能优化规范

前言:      笔者最近上班途中突然想丰富下自己的数据库优化技能。于是在查阅了多篇文章后,总结出了这篇! 数据库命令规范 所有数据库对象名称必须使用小写字母并用下划线分割 所有数据库对象名称禁止使用mysql保留关键字(如果表名中包含关键字查询时,需要将其用单引号括起来) 数据库对象的命名要能做到见名识意,并且最后不要超过32个字符 临时库表必须以tmp_为前缀并以日期为后缀,备份

[MySQL表的增删改查-进阶]

🌈个人主页:努力学编程’ ⛅个人推荐: c语言从初阶到进阶 JavaEE详解 数据结构 ⚡学好数据结构,刷题刻不容缓:点击一起刷题 🌙心灵鸡汤:总有人要赢,为什么不能是我呢 💻💻💻数据库约束 🔭🔭🔭约束类型 not null: 指示某列不能存储 NULL 值unique: 保证某列的每行必须有唯一的值default: 规定没有给列赋值时的默认值.primary key:

MySQL-CRUD入门1

文章目录 认识配置文件client节点mysql节点mysqld节点 数据的添加(Create)添加一行数据添加多行数据两种添加数据的效率对比 数据的查询(Retrieve)全列查询指定列查询查询中带有表达式关于字面量关于as重命名 临时表引入distinct去重order by 排序关于NULL 认识配置文件 在我们的MySQL服务安装好了之后, 会有一个配置文件, 也就