InnoDB的两点特性-插入缓存与双写
亲爱的编程学习爱好者,如果你点开了这篇文章,说明你对《InnoDB的两点特性-插入缓存与双写》很感兴趣。本篇文章就来给大家详细解析一下,主要介绍一下MySQL,希望所有认真读完的童鞋们,都有实质性的提高。
介绍下插入缓冲(insert buffer)与两次写(double write).
缓冲池中缓存的数据页组成
包括索引页,数据页,undo页,插入缓冲,自适应哈希索引,锁信息,数据字典信息等。为了确保缓冲池有限空间的最大利用,Innodb通过LRU算法对缓冲池进行管理,也就是最频繁使用的页在LRU列表最前端,而最少使用的页在LRU列表的尾端,当缓冲池不能存放新读取到的页时,将首先释放LRU列表中尾端的页。需要说明下,Innodb并非使用最朴素的LRU算法,而是在LRU列表里加入了midpoint位置,主要是为了应对活跃的热点数据被刷出的问题,midpoint之后中的列表称为old列表,midpoint之前的列表称为new列表,而new列表里都是最为活跃的热点数据。

插入缓冲
为什么需要插入缓冲?
Innodb存储引擎中行记录是按照聚集索引维度顺序存储的,Innodb的表也称为索引表;因为行记录只能按照一个维度进行排序,所以一张表只能有一个聚集索引。
在InnoDB,主键是行唯一标识,通常应用程序中行记录的插入顺序是按照主键递增的顺序进行插入的,因此,插入聚集索引一般是顺序的,不需要磁盘的随机读取。但是对于非聚集索引叶子节点的插入不再是顺序的了,这时就需要离散地访问非聚集索引页(这里再进一步阐明下,非聚集索引的根节点存的是索引列的值,它们是有序的,而根节点下的叶子节存的是主键的值,它们是无序的。又因为行记录是按照聚集索引维度顺序存储的,为了保住插入后的有序性,我们就必须随机离散地访问非聚集索引页以找到叶子节点的主键值),这里就需要离散地访问非聚集索引页,显然,随机读取是会导致插入操作性能下降。
这样,InnDB设计了Insert Buffer功能:对于非聚集索引的插入或更新操作,不是每一次直接插入到索引页中,而是先判断插入的非聚集索引页是否在缓冲池中,若在,则直接插入;若不在,则先放入到一个Insert Buffer对象中,然后再以一定频率和情况进行Insert Buffer和辅助索引叶子节点的merge操作,这时通常能将多个插入合并到一个操作中,也就是让数据积累到一定量然后批量操作,这就大大提高了对于非聚集索引插入的性能。
不过,Insert Buffer的使用需要同时满足两个条件:
- 索引是辅助索引
- 索引不是唯一索引(数据库并不去查找索引页来判断插入的记录是否唯一,如果进行了判断会有离散读的情况发生)
Change Buffer
Change Buffer是对Insert Buffer的升级。如果没有使用Change Buffer,要对不在缓冲池里的非唯一索引页进行修改,那流程是怎样的呢?
- 先把需要修改的索引页从磁盘加载到缓冲池,一次磁盘随机读操作(随机读写性能要差);
- 修改缓冲池中的页,一次内存操作;
- 写入redo log,一次磁盘顺序写操作(顺序读写性能要高);
可以看到会出现两磁盘操作(有一次还是随机的),一次内存操作。那如果使用了Change Buffer又是怎样的流程呢?
- 在写缓冲中记录这个操作(insert的操作而非update操作),一次内存操作;
- 写入redo log(为了保证数据不丢失),一次磁盘顺序写操作;
换句话就是:对页进行了写操作,并不会立刻将磁盘页加载到缓冲池,而仅仅记录缓冲变更(buffer changes),等未来数据被读取时,会先从磁盘中读取数据页到内存中,然后先执行change buffer的merge操作,保证数据逻辑的正确性。除了查询操作外,系统有后台线程会定期merge,数据库正常关闭(shutdown)的时候,也会进行merge操作。
写缓冲的目的是降低写操作的磁盘IO,提升数据库性能。这里只会出现一次磁盘的顺序操作与一次内存操作,所以性能会很高。
要注意的是,Change Buffer比较适合的业务是写多读少,或者不是写后立刻读取。
Insert Buffer与Change Buffer都是针对的非唯一索引,那这里再展开一唯一索引与非唯一索引的一点区别,也分了读与写两方面。
- 读时的区别。比如有这样一条SQL:select * from table where k=5;
k是唯一索引:因为是唯一索引,所以在查找到第一条满足条件的数据后就返回;
k是非唯一索引:因为是非唯一索引,所以在查找到第一条满足k=5后,还会继续遍历下一条,直到查到的k != 5的时候结束遍历。
那这两者性能差别大吗?其实并不大,因为有在每次进行查询的时候不仅仅查询当前条件的数据,而是会将整个页的数据查出,再加上缓冲区里的数据页缓冲,所以它们的差别在查询上体现的并不明显。
但对增删改操作就不一样了。 - 增删改操作时的区别。
因为对唯一索引的写操作都需要判断是否违反唯一约束,所以每次更新都需要从内存中查找对应的记录,要是内存里没有需要去磁盘上查询,查到数据后还会马上更新内存里的数据,这样来看,change buffer对唯一索引的写操作就没有意义了;而对于非唯一索引每次只需要从内存里查询,要是没查到只是在内存里将数据记录下来,等后期读取的时候再与磁盘里的数据进行合并,这样change buffer在性能上就起到了很大的作用。
参考文章:MySQL中的change buffer
Double Write
Insert Buffer对于InnoDB来说是性能上的提升,那Double Write则是数据页可靠性的保证。来看张图:

- 通过memcpy函数将脏页先复制到内存中的doublewrite buffer。
- 通过doublewrite buffer分两次,每次1MB顺序写入共享表空间的物理磁盘上,然后调用fsync函数同步磁盘。
- 完成doublewrite buffer页的写入后,再将doublewrite buffer中的页离散写入各个表空间文件中。
如果第2步出现了问题,也就是doublewrite写入失败,innodb会载入磁盘原始数据和redo日志比较,并重新刷到doublewrite buffer。
如果第3步出了问题,innodb可以从共享表空间中的doublewrite中找到该页的一个副本,将其复制到表空间文件,再应用重做日志。
最后上张图:

对这张图里关于redo与binary log使用两段式提交说明下,因为redolog影响主库的数据,binlog影响从库的数据,所以redolog和binlog必须保持一致才能保证主从数据一致,所以会采用内部XA事务。
参考的文章:
写缓冲(change buffer),这次彻底懂了!!!
InnoDB关键特性之double write
【mysql】Innodb三大特性之double write
mysql 不会丢失数据吗_MySQL是如何保证数据不会丢的
好了,本文到此结束,带大家了解了《InnoDB的两点特性-插入缓存与双写》,希望本文对你有所帮助!关注golang学习网公众号,给大家分享更多数据库知识!

- 上一篇
- MySQL -- 悲观锁与乐观锁的业务应用

- 下一篇
- mysql 存储过程批量处理带分隔符的字符串
-
- 英俊的冷风
- 太全面了,收藏了,感谢师傅的这篇文章,我会继续支持!
- 2023-03-26 12:11:19
-
- 淡然的萝莉
- 写的不错,一直没懂这个问题,但其实工作中常常有遇到...不过今天到这,看完之后很有帮助,总算是懂了,感谢博主分享文章内容!
- 2023-02-27 08:59:16
-
- 疯狂的草莓
- 这篇文章太及时了,好细啊,感谢大佬分享,码起来,关注楼主了!希望楼主能多写数据库相关的文章。
- 2023-02-18 21:47:45
-
- 数据库 · MySQL | 8小时前 |
- MySQL无法启动?8个排查方法全解析
- 174浏览 收藏
-
- 数据库 · MySQL | 10小时前 |
- 主键与唯一键区别,如何选主键?
- 166浏览 收藏
-
- 数据库 · MySQL | 12小时前 |
- MySQL多表连接优化技巧与实战策略
- 221浏览 收藏
-
- 数据库 · MySQL | 1天前 |
- MySQL排序优化与性能提升技巧
- 153浏览 收藏
-
- 数据库 · MySQL | 1天前 |
- MySQL中WHERE与HAVING的区别详解
- 340浏览 收藏
-
- 数据库 · MySQL | 1天前 |
- MySQL排序优化与性能提升技巧
- 368浏览 收藏
-
- 数据库 · MySQL | 1天前 |
- MySQL连接池配置与优化方法
- 297浏览 收藏
-
- 数据库 · MySQL | 1天前 |
- MySQLGROUPBY使用技巧与常见问题
- 306浏览 收藏
-
- 数据库 · MySQL | 2天前 |
- MySQL缓存优化技巧分享
- 392浏览 收藏
-
- 数据库 · MySQL | 2天前 |
- MySQL安装到D盘教程及路径设置详解
- 279浏览 收藏
-
- 数据库 · MySQL | 2天前 |
- MySQL缓存设置及查询作用解析
- 470浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 511次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 498次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- 千音漫语
- 千音漫语,北京熠声科技倾力打造的智能声音创作助手,提供AI配音、音视频翻译、语音识别、声音克隆等强大功能,助力有声书制作、视频创作、教育培训等领域,官网:https://qianyin123.com
- 96次使用
-
- MiniWork
- MiniWork是一款智能高效的AI工具平台,专为提升工作与学习效率而设计。整合文本处理、图像生成、营销策划及运营管理等多元AI工具,提供精准智能解决方案,让复杂工作简单高效。
- 89次使用
-
- NoCode
- NoCode (nocode.cn)是领先的无代码开发平台,通过拖放、AI对话等简单操作,助您快速创建各类应用、网站与管理系统。无需编程知识,轻松实现个人生活、商业经营、企业管理多场景需求,大幅降低开发门槛,高效低成本。
- 108次使用
-
- 达医智影
- 达医智影,阿里巴巴达摩院医疗AI创新力作。全球率先利用平扫CT实现“一扫多筛”,仅一次CT扫描即可高效识别多种癌症、急症及慢病,为疾病早期发现提供智能、精准的AI影像早筛解决方案。
- 98次使用
-
- 智慧芽Eureka
- 智慧芽Eureka,专为技术创新打造的AI Agent平台。深度理解专利、研发、生物医药、材料、科创等复杂场景,通过专家级AI Agent精准执行任务,智能化工作流解放70%生产力,让您专注核心创新。
- 100次使用
-
- golang MySQL实现对数据库表存储获取操作示例
- 2022-12-22 499浏览
-
- 搞一个自娱自乐的博客(二) 架构搭建
- 2023-02-16 244浏览
-
- B-Tree、B+Tree以及B-link Tree
- 2023-01-19 235浏览
-
- mysql面试题
- 2023-01-17 157浏览
-
- MySQL数据表简单查询
- 2023-01-10 101浏览